Olmo 3.1 32B Think: benchmarks y ficha
Lanzamiento
2025-12-12
Olmo 3.1 32B Think es un modelo de lenguaje de Allen Institute for AI con capacidades de reasoning de pesos abiertos. En el índice de inteligencia de Weben48 obtiene 8.1/100, con un contexto de 66K tokens y un precio de Gratis por millón de tokens.
Actualizado: 6 de agosto de 2026. Fuente: Artificial Analysis; precios contrastados con OpenRouter.
Índice de inteligencia
Índice estimado a partir de benchmarks públicos.
Benchmarks detallados
| Benchmark | Puntuación |
|---|---|
| gpqa | 59.1% |
| hle | 6.0% |
| scicode | 29.3% |
| ifbench | 66.0% |
| tau2 | 0.0% |
| terminalbenchHard | 0.0% |
| omniscienceAccuracy | 13.6% |
Fuente: Artificial Analysis. Solo los valores entre 0 y 1 se normalizan a porcentaje.
Olmo 3.1 32B Think vs otros modelos
| Modelo | Inteligencia | Precio/1M | Contexto |
|---|---|---|---|
| Olmo 3.1 32B Think | 8.1/100 | Gratis | 66K |
| Claude Opus 5 (max) | 60.7/100 | $10.00 | 1.0M |
| Claude Opus 5 (xhigh) | 60.1/100 | $10.00 | 1.0M |
| Claude Fable 5 (with fallback) | 59.9/100 | $20.00 | 1.0M |
| GPT-5.6 Sol (max) | 58.9/100 | $11.25 | 1.0M |
| Claude Opus 5 (high) | 58.9/100 | $10.00 | 1.0M |
Preguntas frecuentes sobre Olmo 3.1 32B Think
¿Qué es Olmo 3.1 32B Think? expand_more
Olmo 3.1 32B Think es un modelo de lenguaje de Allen Institute for AI con capacidades de reasoning de pesos abiertos. En el índice de inteligencia de Weben48 obtiene 8.1/100, con un contexto de 66K tokens y un precio de Gratis por millón de tokens.
¿Cuánto cuesta Olmo 3.1 32B Think? expand_more
El precio de entrada es Gratis por millón de tokens y el de salida Gratis por millón. El precio blended estimado es Gratis. Fuentes: Artificial Analysis y OpenRouter.
¿Cuál es el contexto de Olmo 3.1 32B Think? expand_more
Olmo 3.1 32B Think admite una ventana de contexto de 66K tokens y tiene aproximadamente 32.2B parámetros.
¿Olmo 3.1 32B Think es open source? expand_more
Sí. Olmo 3.1 32B Think publica pesos abiertos bajo licencia Apache 2.0.
Análisis relacionados
Benchmarks oficiales vs independientes: dos evidencias, no dos bandos
El laboratorio explica el producto y el independiente compara bajo un arnés común. Usar ambos reduce el riesgo de confundir marketing, configuración favorable y rendimiento general.
Coding por presupuesto: elegir modelo antes de abrir el editor
Un presupuesto de coding convierte una discusión abstracta en un límite operativo. Los modelos más capaces pueden ahorrar rondas; los baratos pueden ganar en tareas repetibles.
Cómo leer el Intelligence Index sin convertirlo en dogma
El Intelligence Index es una síntesis útil porque agrupa tareas de agentes, código, ciencia y conocimiento. No es un sustituto de una evaluación en tu dominio ni de una prueba de coste.
Contexto anunciado vs contexto útil: el límite que se descubre tarde
Una ventana grande solo ayuda si el modelo recupera lo relevante, mantiene instrucciones y no dispara el coste. El número anunciado es capacidad; la utilidad es una prueba.