Decidir Ranking de modelos de IA: inteligencia, benchmarks y precio Ranking de modelos de IA: inteligencia, benchmarks y precio Cada punto es un modelo: cuanto más arriba, mejor clasificado; cuanto más a la izquierda, más barato. Haga clic en un modelo para verlo solo.
Todos los modelos Pesos abiertos Solo API
Zona más interesante 140 150 160 170 0,10 € 0,30 € 1,00 € 3,00 € 10,00 € 30,00 € Precio por millón de tokens (€, 3/4 entrada + 1/4 salida, escala log) Índice de capacidades de Epoch (ECI) Claude Opus 5.5 (Anthropic) · Puntuación 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Puntuación 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Puntuación 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Puntuación 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Puntuación 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Puntuación 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Puntuación 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Puntuación 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Puntuación 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Puntuación 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Puntuación 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Puntuación 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Puntuación 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Puntuación 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Puntuación 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Puntuación 156,6 · 1,78 € / 5,35 € Grok 4.6 Pesos abiertos Solo API Línea de Pareto Claude Opus 5.5 🇺🇸 Anthropic · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 167,3 1.º de 37 en puntuación · intervalo de confianza 164,0–172,0
Precio por millón de tokens · combinado 7,13 € 13.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 90,6 %
SWE-bench Verified — no medido
FrontierMath 91,2 %
SimpleQA Verified 72,2 %
MATH Level 5 — no medido
En la línea de Pareto: ningún modelo es a la vez mejor y más barato.
Claude Sonnet 5.5 🇺🇸 Anthropic · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 165,2 3.º de 37 en puntuación · intervalo de confianza 161,8–169,4
Precio por millón de tokens · combinado 3,56 € 12.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 95,6 %
SWE-bench Verified — no medido
FrontierMath 88,8 %
SimpleQA Verified 46,5 %
MATH Level 5 — no medido
En la línea de Pareto: ningún modelo es a la vez mejor y más barato.
Claude Haiku 4.5 🇺🇸 Anthropic · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 142,4 30.º de 37 en puntuación · intervalo de confianza 139,5–144,3
Precio por millón de tokens · combinado 1,78 € 7.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 71,2 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified 13,2 %
MATH Level 5 96,4 %
Fuera de la línea de Pareto: superado en puntuación y en precio por 6.
GPT-5.6 Sol 🇺🇸 OpenAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 161,8 5.º de 37 en puntuación · intervalo de confianza 159,3–165,3
Precio por millón de tokens · combinado 7,13 € 13.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 93,5 %
SWE-bench Verified — no medido
FrontierMath 89,1 %
SimpleQA Verified 69,7 %
MATH Level 5 — no medido
precio promocional, al menos hasta el 21/11/2026
Fuera de la línea de Pareto: superado en puntuación y en precio por 1.
GPT-5.6 Terra 🇺🇸 OpenAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 159,8 6.º de 37 en puntuación · intervalo de confianza 157,1–162,8
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 93,3 %
SWE-bench Verified — no medido
FrontierMath 86,0 %
SimpleQA Verified 43,2 %
MATH Level 5 — no medido
GPT-5.6 Luna 🇺🇸 OpenAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 156,4 13.º de 37 en puntuación · intervalo de confianza 154,1–158,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 91,6 %
SWE-bench Verified — no medido
FrontierMath 82,1 %
SimpleQA Verified 41,0 %
MATH Level 5 — no medido
Gemini 3.8 Flash 🇺🇸 Google · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 156,9 9.º de 37 en puntuación · intervalo de confianza 154,6–160,4
Precio por millón de tokens · combinado 1,34 € 4.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 95,4 %
SWE-bench Verified — no medido
FrontierMath 68,4 %
SimpleQA Verified 69,7 %
MATH Level 5 — no medido
hasta el 31/12/2026, después 1,50 $ / 7,50 $
Fuera de la línea de Pareto: superado en puntuación y en precio por 0.
Muse Spark 1.3 🇺🇸 Meta · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 156,9 9.º de 37 en puntuación · intervalo de confianza 154,7–159,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond — no medido
SWE-bench Verified — no medido
FrontierMath 74,4 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
Grok 4.5 🇺🇸 xAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 154,0 17.º de 37 en puntuación · intervalo de confianza 152,3–156,1
Precio por millón de tokens · combinado 2,67 € 10.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 93,4 %
SWE-bench Verified — no medido
FrontierMath 57,2 %
SimpleQA Verified 48,3 %
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 5.
Qwen3.8 Max 🇨🇳 Alibaba · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 156,6 11.º de 37 en puntuación · intervalo de confianza 154,5–158,8
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 92,7 %
SWE-bench Verified — no medido
FrontierMath 74,7 %
SimpleQA Verified 45,8 %
MATH Level 5 — no medido
GLM-5.3 🇨🇳 Z.ai · Pesos abiertos: sí · Licencia: MIT
Ver todos los modelos Puntuación 155,8 14.º de 37 en puntuación · intervalo de confianza 153,7–158,3
Precio por millón de tokens · combinado 1,92 € 8.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — no medido
FrontierMath 68,8 %
SimpleQA Verified 41,0 %
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 2.
Recursos para ejecutarlo en su equipo →
GLM-5.3 Flash 🇨🇳 Z.ai · Pesos abiertos: sí · Licencia: MIT
Ver todos los modelos Puntuación 151,9 18.º de 37 en puntuación · intervalo de confianza 149,4–154,3
Precio por millón de tokens · combinado 0,21 € 1.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 90,2 %
SWE-bench Verified — no medido
FrontierMath 55,8 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
En la línea de Pareto: ningún modelo es a la vez mejor y más barato.
Recursos para ejecutarlo en su equipo →
DeepSeek V4.1 Flash 🇨🇳 DeepSeek · Pesos abiertos: sí · Licencia: MIT
Ver todos los modelos Puntuación 155,0 16.º de 37 en puntuación · intervalo de confianza 148,8–157,6
Precio por millón de tokens · combinado 0,47 € 2.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond — no medido
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
tarifa en horas punta, mitad de precio en horas valle
En la línea de Pareto: ningún modelo es a la vez mejor y más barato.
Recursos para ejecutarlo en su equipo →
DeepSeek V4 Pro 🇨🇳 DeepSeek · Pesos abiertos: sí · Licencia: MIT
Ver todos los modelos Puntuación 155,4 15.º de 37 en puntuación · intervalo de confianza 153,7–157,6
Precio por millón de tokens · combinado 1,76 € 6.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 91,7 %
SWE-bench Verified — no medido
FrontierMath 64,6 %
SimpleQA Verified 52,9 %
MATH Level 5 — no medido
tarifa en horas punta, mitad de precio en horas valle
Fuera de la línea de Pareto: superado en puntuación y en precio por 2.
Recursos para ejecutarlo en su equipo →
Qwen3.8 27B 🇨🇳 Alibaba · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 149,4 21.º de 37 en puntuación · intervalo de confianza 147,4–151,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond — no medido
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Qwen3.5 397B 🇨🇳 Alibaba · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 146,7 24.º de 37 en puntuación · intervalo de confianza 144,8–148,2
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 86,4 %
SWE-bench Verified — no medido
FrontierMath 31,2 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
MiniMax M3 🇨🇳 MiniMax · Pesos abiertos: sí · Licencia: MiniMax Community License
Ver todos los modelos Puntuación 147,0 23.º de 37 en puntuación · intervalo de confianza 142,7–149,8
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Gemma 4 31B 🇺🇸 Google · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 142,8 29.º de 37 en puntuación · intervalo de confianza 140,3–144,9
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified 10,4 %
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Mistral Medium 3.5 🇫🇷 Mistral AI · Pesos abiertos: sí · Licencia: Modified MIT
Ver todos los modelos Puntuación 141,4 32.º de 37 en puntuación · intervalo de confianza 138,4–143,7
Precio por millón de tokens · combinado 2,67 € 9.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond — no medido
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 8.
Recursos para ejecutarlo en su equipo →
Mistral Small 3.2 🇫🇷 Mistral AI · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 131,7 37.º de 37 en puntuación · intervalo de confianza 126,6–133,9
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 49,1 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
gpt-oss-120b 🇺🇸 OpenAI · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 139,9 33.º de 37 en puntuación · intervalo de confianza 135,3–142,3
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
gpt-oss-20b 🇺🇸 OpenAI · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 137,8 35.º de 37 en puntuación · intervalo de confianza 133,0–139,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 60,8 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Llama 4 Maverick 🇺🇸 Meta · Pesos abiertos: sí · Licencia: Llama 4
Ver todos los modelos Puntuación 132,2 36.º de 37 en puntuación · intervalo de confianza 128,0–134,1
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 67,0 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 73,0 %
Recursos para ejecutarlo en su equipo →
GPT-6 Astra 🇺🇸 OpenAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 166,5 2.º de 37 en puntuación · intervalo de confianza 163,1–171,1
Precio por millón de tokens · combinado 17,82 € 15.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 95,8 %
SWE-bench Verified — no medido
FrontierMath 93,7 %
SimpleQA Verified 75,6 %
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 1.
Claude Fable 5.1 🇺🇸 Anthropic · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 164,8 4.º de 37 en puntuación · intervalo de confianza 161,8–169,1
Precio por millón de tokens · combinado 17,82 € 15.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond — no medido
SWE-bench Verified — no medido
FrontierMath 90,2 %
SimpleQA Verified 70,8 %
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 2.
Gemini 3.7 Flash 🇺🇸 Google · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 157,4 8.º de 37 en puntuación · intervalo de confianza 155,4–160,1
Precio por millón de tokens · combinado 1,34 € 4.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 94,8 %
SWE-bench Verified — no medido
FrontierMath 71,6 %
SimpleQA Verified 69,2 %
MATH Level 5 — no medido
hasta el 31/12/2026, después 1,50 $ / 7,50 $
En la línea de Pareto: ningún modelo es a la vez mejor y más barato.
Gemini 3.5 Flash-Lite 🇺🇸 Google · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 145,1 26.º de 37 en puntuación · intervalo de confianza 142,5–146,7
Precio por millón de tokens · combinado 0,76 € 3.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 83,3 %
SWE-bench Verified — no medido
FrontierMath 26,0 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 2.
Grok 4.6 🇺🇸 xAI · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 156,6 11.º de 37 en puntuación · intervalo de confianza 154,7–158,9
Precio por millón de tokens · combinado 2,67 € 10.º de 16 en precio
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 94,0 %
SWE-bench Verified — no medido
FrontierMath 66,0 %
SimpleQA Verified 49,3 %
MATH Level 5 — no medido
Fuera de la línea de Pareto: superado en puntuación y en precio por 2.
Qwen3.7 Flash 🇨🇳 Alibaba · Pesos abiertos: no · Licencia: Propietaria
Ver todos los modelos Puntuación 144,6 27.º de 37 en puntuación · intervalo de confianza 142,4–147,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 82,3 %
SWE-bench Verified — no medido
FrontierMath 19,3 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
Kimi K3 🇨🇳 Moonshot AI · Pesos abiertos: sí · Licencia: Kimi K3 license
Ver todos los modelos Puntuación 157,6 7.º de 37 en puntuación · intervalo de confianza 154,9–160,4
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 93,1 %
SWE-bench Verified — no medido
FrontierMath 72,2 %
SimpleQA Verified 50,6 %
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Kimi K2.7 Code 🇨🇳 Moonshot AI · Pesos abiertos: sí · Licencia: —
Ver todos los modelos Puntuación 150,0 20.º de 37 en puntuación · intervalo de confianza 148,1–151,8
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 87,9 %
SWE-bench Verified — no medido
FrontierMath 54,0 %
SimpleQA Verified 36,5 %
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Inkling 🇺🇸 Thinking Machines · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 148,6 22.º de 37 en puntuación · intervalo de confianza 145,7–150,6
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 88,3 %
SWE-bench Verified — no medido
FrontierMath 33,3 %
SimpleQA Verified 40,3 %
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Inkling Small 🇺🇸 Thinking Machines · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 150,2 19.º de 37 en puntuación · intervalo de confianza 147,5–152,1
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 88,5 %
SWE-bench Verified — no medido
FrontierMath 46,3 %
SimpleQA Verified 19,1 %
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Nemotron 3 Ultra 🇺🇸 Nvidia · Pesos abiertos: sí · Licencia: OpenMDW-1.1
Ver todos los modelos Puntuación 146,2 25.º de 37 en puntuación · intervalo de confianza 143,9–148,1
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 85,4 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Qwen3.6 35B-A3B 🇨🇳 Alibaba · Pesos abiertos: sí · Licencia: —
Ver todos los modelos Puntuación 143,9 28.º de 37 en puntuación · intervalo de confianza 141,2–146,0
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 84,8 %
SWE-bench Verified — no medido
FrontierMath 20,4 %
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Gemma 4 26B A4B 🇺🇸 Google · Pesos abiertos: sí · Licencia: Apache 2.0
Ver todos los modelos Puntuación 141,8 31.º de 37 en puntuación · intervalo de confianza 138,4–143,4
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 73,2 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Qwen3.5 9B 🇨🇳 Alibaba · Pesos abiertos: sí · Licencia: —
Ver todos los modelos Puntuación 139,5 34.º de 37 en puntuación · intervalo de confianza 136,4–141,3
Precio por millón de tokens — El desarrollador no publica un precio oficial: este modelo no aparece en el gráfico.
Benchmarks (mejor resultado medido por Epoch) GPQA Diamond 79,0 %
SWE-bench Verified — no medido
FrontierMath — no medido
SimpleQA Verified — no medido
MATH Level 5 — no medido
Recursos para ejecutarlo en su equipo →
Modelo Desarrollador Pesos abiertos Licencia Puntuación Precio entrada / salida Precio combinado GPQA Diamond Claude Opus 5.5 Pareto 🇺🇸 Anthropic no Propietaria 167,3 3,56 € / 17,82 € 7,13 € 90,6 % GPT-6 Astra 🇺🇸 OpenAI no Propietaria 166,5 8,91 € / 44,54 € 17,82 € 95,8 % Claude Sonnet 5.5 Pareto 🇺🇸 Anthropic no Propietaria 165,2 1,78 € / 8,91 € 3,56 € 95,6 % Claude Fable 5.1 🇺🇸 Anthropic no Propietaria 164,8 8,91 € / 44,54 € 17,82 € — GPT-5.6 Sol 🇺🇸 OpenAI no Propietaria 161,8 3,56 € / 17,82 € 7,13 € 93,5 % GPT-5.6 Terra 🇺🇸 OpenAI no Propietaria 159,8 no publicado — 93,3 % Kimi K3 🇨🇳 Moonshot AI sí Kimi K3 license 157,6 no publicado — 93,1 % Gemini 3.7 Flash Pareto 🇺🇸 Google no Propietaria 157,4 0,67 € / 3,34 € 1,34 € 94,8 % Gemini 3.8 Flash 🇺🇸 Google no Propietaria 156,9 0,67 € / 3,34 € 1,34 € 95,4 % Muse Spark 1.3 🇺🇸 Meta no Propietaria 156,9 no publicado — — Qwen3.8 Max 🇨🇳 Alibaba no Propietaria 156,6 no publicado — 92,7 % Grok 4.6 🇺🇸 xAI no Propietaria 156,6 1,78 € / 5,35 € 2,67 € 94,0 % GPT-5.6 Luna 🇺🇸 OpenAI no Propietaria 156,4 no publicado — 91,6 % GLM-5.3 🇨🇳 Z.ai sí MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 % DeepSeek V4 Pro 🇨🇳 DeepSeek sí MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 % DeepSeek V4.1 Flash Pareto 🇨🇳 DeepSeek sí MIT 155,0 0,27 € / 1,07 € 0,47 € — Grok 4.5 🇺🇸 xAI no Propietaria 154,0 1,78 € / 5,35 € 2,67 € 93,4 % GLM-5.3 Flash Pareto 🇨🇳 Z.ai sí MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 % Inkling Small 🇺🇸 Thinking Machines sí Apache 2.0 150,2 no publicado — 88,5 % Kimi K2.7 Code 🇨🇳 Moonshot AI sí — 150,0 no publicado — 87,9 % Qwen3.8 27B 🇨🇳 Alibaba sí Apache 2.0 149,4 no publicado — — Inkling 🇺🇸 Thinking Machines sí Apache 2.0 148,6 no publicado — 88,3 % MiniMax M3 🇨🇳 MiniMax sí MiniMax Community License 147,0 no publicado — 90,9 % Qwen3.5 397B 🇨🇳 Alibaba sí Apache 2.0 146,7 no publicado — 86,4 % Nemotron 3 Ultra 🇺🇸 Nvidia sí OpenMDW-1.1 146,2 no publicado — 85,4 % Gemini 3.5 Flash-Lite 🇺🇸 Google no Propietaria 145,1 0,27 € / 2,23 € 0,76 € 83,3 % Qwen3.7 Flash 🇨🇳 Alibaba no Propietaria 144,6 no publicado — 82,3 % Qwen3.6 35B-A3B 🇨🇳 Alibaba sí — 143,9 no publicado — 84,8 % Gemma 4 31B 🇺🇸 Google sí Apache 2.0 142,8 no publicado — 75,8 % Claude Haiku 4.5 🇺🇸 Anthropic no Propietaria 142,4 0,89 € / 4,45 € 1,78 € 71,2 % Gemma 4 26B A4B 🇺🇸 Google sí Apache 2.0 141,8 no publicado — 73,2 % Mistral Medium 3.5 🇫🇷 Mistral AI sí Modified MIT 141,4 1,34 € / 6,68 € 2,67 € — gpt-oss-120b 🇺🇸 OpenAI sí Apache 2.0 139,9 no publicado — 75,8 % Qwen3.5 9B 🇨🇳 Alibaba sí — 139,5 no publicado — 79,0 % gpt-oss-20b 🇺🇸 OpenAI sí Apache 2.0 137,8 no publicado — 60,8 % Llama 4 Maverick 🇺🇸 Meta sí Llama 4 132,2 no publicado — 67,0 % Mistral Small 3.2 🇫🇷 Mistral AI sí Apache 2.0 131,7 no publicado — 49,1 %
Preguntas frecuentes ¿Qué significa «pesos abiertos»? Los pesos son los miles de millones de números que contienen lo que un modelo ha aprendido. Un modelo de pesos abiertos se puede descargar y ejecutar en su propio equipo; un modelo cerrado solo es accesible a través de la API de su desarrollador. Pesos abiertos no significa código abierto: la licencia puede limitar el uso.
¿Cómo se mide la inteligencia de los modelos? Con el índice de capacidades de Epoch AI (ECI), que combina los resultados de muchos benchmarks: razonamiento científico (GPQA Diamond), código (SWE-bench Verified), matemáticas (FrontierMath), exactitud factual (SimpleQA Verified).
¿De dónde vienen los precios? De las páginas oficiales de precios de los desarrolladores, en dólares por millón de tokens, convertidos a euros al tipo de referencia del Banco Central Europeo. El precio combinado cuenta 3/4 del precio de entrada y 1/4 del de salida.
¿Qué es la línea de Pareto? Une los modelos que ningún otro supera a la vez en inteligencia y en precio: son los mejores compromisos del momento.
¿Le ha resultado útil esta información?