Llama 3.1 Nemotron Instruct 70B: benchmarks y ficha
Lanzamiento
2024-10-15
Llama 3.1 Nemotron 70B es un modelo de lenguaje de NVIDIA de pesos abiertos. En el índice de inteligencia de Weben48 obtiene 7.6/100, con un contexto de 128K tokens y un precio de $1.20 por millón de tokens.
Actualizado: 6 de agosto de 2026. Fuente: Artificial Analysis; precios contrastados con OpenRouter.
Índice de inteligencia
Índice estimado a partir de benchmarks públicos.
Benchmarks detallados
| Benchmark | Puntuación |
|---|---|
| gpqa | 46.5% |
| hle | 4.6% |
| scicode | 23.3% |
| ifbench | 30.7% |
| tau2 | 23.1% |
| terminalbenchHard | 4.5% |
| omniscienceAccuracy | 16.5% |
Fuente: Artificial Analysis. Solo los valores entre 0 y 1 se normalizan a porcentaje.
Llama 3.1 Nemotron 70B vs otros modelos
| Modelo | Inteligencia | Precio/1M | Contexto |
|---|---|---|---|
| Llama 3.1 Nemotron 70B | 7.6/100 | $1.20 | 128K |
| Claude Opus 5 (max) | 60.7/100 | $10.00 | 1.0M |
| Claude Opus 5 (xhigh) | 60.1/100 | $10.00 | 1.0M |
| Claude Fable 5 (with fallback) | 59.9/100 | $20.00 | 1.0M |
| GPT-5.6 Sol (max) | 58.9/100 | $11.25 | 1.0M |
| Claude Opus 5 (high) | 58.9/100 | $10.00 | 1.0M |
Preguntas frecuentes sobre Llama 3.1 Nemotron 70B
¿Qué es Llama 3.1 Nemotron 70B? expand_more
Llama 3.1 Nemotron 70B es un modelo de lenguaje de NVIDIA de pesos abiertos. En el índice de inteligencia de Weben48 obtiene 7.6/100, con un contexto de 128K tokens y un precio de $1.20 por millón de tokens.
¿Cuánto cuesta Llama 3.1 Nemotron 70B? expand_more
El precio de entrada es $1.20 por millón de tokens y el de salida $1.20 por millón. El precio blended estimado es $1.20. Fuentes: Artificial Analysis y OpenRouter.
¿Cuál es el contexto de Llama 3.1 Nemotron 70B? expand_more
Llama 3.1 Nemotron 70B admite una ventana de contexto de 128K tokens y tiene aproximadamente 70B parámetros.
¿Llama 3.1 Nemotron 70B es open source? expand_more
Sí. Llama 3.1 Nemotron 70B publica pesos abiertos bajo licencia LLAMA 3.1 COMMUNITY LICENSE AGREEMENT.
Análisis relacionados
Benchmarks oficiales vs independientes: dos evidencias, no dos bandos
El laboratorio explica el producto y el independiente compara bajo un arnés común. Usar ambos reduce el riesgo de confundir marketing, configuración favorable y rendimiento general.
Coding por presupuesto: elegir modelo antes de abrir el editor
Un presupuesto de coding convierte una discusión abstracta en un límite operativo. Los modelos más capaces pueden ahorrar rondas; los baratos pueden ganar en tareas repetibles.
Cómo leer el Intelligence Index sin convertirlo en dogma
El Intelligence Index es una síntesis útil porque agrupa tareas de agentes, código, ciencia y conocimiento. No es un sustituto de una evaluación en tu dominio ni de una prueba de coste.
Contexto anunciado vs contexto útil: el límite que se descubre tarde
Una ventana grande solo ayuda si el modelo recupera lo relevante, mantiene instrucciones y no dispara el coste. El número anunciado es capacidad; la utilidad es una prueba.