Decidir Classificação dos modelos de IA: inteligência, benchmarks e preço Classificação dos modelos de IA: inteligência, benchmarks e preço Cada ponto é um modelo: quanto mais alto, melhor classificado; quanto mais à esquerda, mais barato. Clique num modelo para o ver sozinho.
Todos os modelos Pesos abertos Só API
Zona mais interessante 140 150 160 170 0,10 € 0,30 € 1,00 € 3,00 € 10,00 € 30,00 € Preço por milhão de tokens (€, 3/4 entrada + 1/4 saída, escala logarítmica) Epoch Capabilities Index (ECI) Claude Opus 5.5 (Anthropic) · Pontuação 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Pontuação 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Pontuação 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Pontuação 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Pontuação 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Pontuação 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Pontuação 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Pontuação 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Pontuação 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Pontuação 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Pontuação 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Pontuação 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Pontuação 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Pontuação 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Pontuação 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Pontuação 156,6 · 1,78 € / 5,35 € Grok 4.6 Pesos abertos Só API Linha de Pareto Claude Opus 5.5 🇺🇸 Anthropic · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 167,3 1.º de 37 em pontuação · intervalo de confiança 164,0–172,0
Preço por milhão de tokens · combinado 7,13 € 13.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 90,6 %
SWE-bench Verified — não medido
FrontierMath 91,2 %
SimpleQA Verified 72,2 %
MATH Level 5 — não medido
Na linha de Pareto: nenhum modelo é ao mesmo tempo melhor e mais barato.
Claude Sonnet 5.5 🇺🇸 Anthropic · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 165,2 3.º de 37 em pontuação · intervalo de confiança 161,8–169,4
Preço por milhão de tokens · combinado 3,56 € 12.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 95,6 %
SWE-bench Verified — não medido
FrontierMath 88,8 %
SimpleQA Verified 46,5 %
MATH Level 5 — não medido
Na linha de Pareto: nenhum modelo é ao mesmo tempo melhor e mais barato.
Claude Haiku 4.5 🇺🇸 Anthropic · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 142,4 30.º de 37 em pontuação · intervalo de confiança 139,5–144,3
Preço por milhão de tokens · combinado 1,78 € 7.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 71,2 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified 13,2 %
MATH Level 5 96,4 %
Fora da linha de Pareto: superado em pontuação e em preço por 6.
GPT-5.6 Sol 🇺🇸 OpenAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 161,8 5.º de 37 em pontuação · intervalo de confiança 159,3–165,3
Preço por milhão de tokens · combinado 7,13 € 13.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 93,5 %
SWE-bench Verified — não medido
FrontierMath 89,1 %
SimpleQA Verified 69,7 %
MATH Level 5 — não medido
promotional price, at least until 11/21/2026
Fora da linha de Pareto: superado em pontuação e em preço por 1.
GPT-5.6 Terra 🇺🇸 OpenAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 159,8 6.º de 37 em pontuação · intervalo de confiança 157,1–162,8
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 93,3 %
SWE-bench Verified — não medido
FrontierMath 86,0 %
SimpleQA Verified 43,2 %
MATH Level 5 — não medido
GPT-5.6 Luna 🇺🇸 OpenAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 156,4 13.º de 37 em pontuação · intervalo de confiança 154,1–158,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 91,6 %
SWE-bench Verified — não medido
FrontierMath 82,1 %
SimpleQA Verified 41,0 %
MATH Level 5 — não medido
Gemini 3.8 Flash 🇺🇸 Google · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 156,9 9.º de 37 em pontuação · intervalo de confiança 154,6–160,4
Preço por milhão de tokens · combinado 1,34 € 4.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 95,4 %
SWE-bench Verified — não medido
FrontierMath 68,4 %
SimpleQA Verified 69,7 %
MATH Level 5 — não medido
until 12/31/2026, then $1.50 / $7.50
Fora da linha de Pareto: superado em pontuação e em preço por 0.
Muse Spark 1.3 🇺🇸 Meta · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 156,9 9.º de 37 em pontuação · intervalo de confiança 154,7–159,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond — não medido
SWE-bench Verified — não medido
FrontierMath 74,4 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Grok 4.5 🇺🇸 xAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 154,0 17.º de 37 em pontuação · intervalo de confiança 152,3–156,1
Preço por milhão de tokens · combinado 2,67 € 10.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 93,4 %
SWE-bench Verified — não medido
FrontierMath 57,2 %
SimpleQA Verified 48,3 %
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 5.
Qwen3.8 Max 🇨🇳 Alibaba · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 156,6 11.º de 37 em pontuação · intervalo de confiança 154,5–158,8
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 92,7 %
SWE-bench Verified — não medido
FrontierMath 74,7 %
SimpleQA Verified 45,8 %
MATH Level 5 — não medido
GLM-5.3 🇨🇳 Z.ai · Pesos abertos: sim · Licença: MIT
Ver todos os modelos Pontuação 155,8 14.º de 37 em pontuação · intervalo de confiança 153,7–158,3
Preço por milhão de tokens · combinado 1,92 € 8.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — não medido
FrontierMath 68,8 %
SimpleQA Verified 41,0 %
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 2.
Recursos para o executar por si →
GLM-5.3 Flash 🇨🇳 Z.ai · Pesos abertos: sim · Licença: MIT
Ver todos os modelos Pontuação 151,9 18.º de 37 em pontuação · intervalo de confiança 149,4–154,3
Preço por milhão de tokens · combinado 0,21 € 1.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 90,2 %
SWE-bench Verified — não medido
FrontierMath 55,8 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Na linha de Pareto: nenhum modelo é ao mesmo tempo melhor e mais barato.
Recursos para o executar por si →
DeepSeek V4.1 Flash 🇨🇳 DeepSeek · Pesos abertos: sim · Licença: MIT
Ver todos os modelos Pontuação 155,0 16.º de 37 em pontuação · intervalo de confiança 148,8–157,6
Preço por milhão de tokens · combinado 0,47 € 2.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond — não medido
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
peak-hour price, half price off-peak
Na linha de Pareto: nenhum modelo é ao mesmo tempo melhor e mais barato.
Recursos para o executar por si →
DeepSeek V4 Pro 🇨🇳 DeepSeek · Pesos abertos: sim · Licença: MIT
Ver todos os modelos Pontuação 155,4 15.º de 37 em pontuação · intervalo de confiança 153,7–157,6
Preço por milhão de tokens · combinado 1,76 € 6.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 91,7 %
SWE-bench Verified — não medido
FrontierMath 64,6 %
SimpleQA Verified 52,9 %
MATH Level 5 — não medido
peak-hour price, half price off-peak
Fora da linha de Pareto: superado em pontuação e em preço por 2.
Recursos para o executar por si →
Qwen3.8 27B 🇨🇳 Alibaba · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 149,4 21.º de 37 em pontuação · intervalo de confiança 147,4–151,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond — não medido
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Qwen3.5 397B 🇨🇳 Alibaba · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 146,7 24.º de 37 em pontuação · intervalo de confiança 144,8–148,2
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 86,4 %
SWE-bench Verified — não medido
FrontierMath 31,2 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
MiniMax M3 🇨🇳 MiniMax · Pesos abertos: sim · Licença: MiniMax Community License
Ver todos os modelos Pontuação 147,0 23.º de 37 em pontuação · intervalo de confiança 142,7–149,8
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Gemma 4 31B 🇺🇸 Google · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 142,8 29.º de 37 em pontuação · intervalo de confiança 140,3–144,9
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified 10,4 %
MATH Level 5 — não medido
Recursos para o executar por si →
Mistral Medium 3.5 🇫🇷 Mistral AI · Pesos abertos: sim · Licença: Modified MIT
Ver todos os modelos Pontuação 141,4 32.º de 37 em pontuação · intervalo de confiança 138,4–143,7
Preço por milhão de tokens · combinado 2,67 € 9.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond — não medido
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 8.
Recursos para o executar por si →
Mistral Small 3.2 🇫🇷 Mistral AI · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 131,7 37.º de 37 em pontuação · intervalo de confiança 126,6–133,9
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 49,1 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
gpt-oss-120b 🇺🇸 OpenAI · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 139,9 33.º de 37 em pontuação · intervalo de confiança 135,3–142,3
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
gpt-oss-20b 🇺🇸 OpenAI · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 137,8 35.º de 37 em pontuação · intervalo de confiança 133,0–139,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 60,8 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Llama 4 Maverick 🇺🇸 Meta · Pesos abertos: sim · Licença: Llama 4
Ver todos os modelos Pontuação 132,2 36.º de 37 em pontuação · intervalo de confiança 128,0–134,1
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 67,0 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 73,0 %
Recursos para o executar por si →
GPT-6 Astra 🇺🇸 OpenAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 166,5 2.º de 37 em pontuação · intervalo de confiança 163,1–171,1
Preço por milhão de tokens · combinado 17,82 € 15.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 95,8 %
SWE-bench Verified — não medido
FrontierMath 93,7 %
SimpleQA Verified 75,6 %
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 1.
Claude Fable 5.1 🇺🇸 Anthropic · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 164,8 4.º de 37 em pontuação · intervalo de confiança 161,8–169,1
Preço por milhão de tokens · combinado 17,82 € 15.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond — não medido
SWE-bench Verified — não medido
FrontierMath 90,2 %
SimpleQA Verified 70,8 %
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 2.
Gemini 3.7 Flash 🇺🇸 Google · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 157,4 8.º de 37 em pontuação · intervalo de confiança 155,4–160,1
Preço por milhão de tokens · combinado 1,34 € 4.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 94,8 %
SWE-bench Verified — não medido
FrontierMath 71,6 %
SimpleQA Verified 69,2 %
MATH Level 5 — não medido
until 12/31/2026, then $1.50 / $7.50
Na linha de Pareto: nenhum modelo é ao mesmo tempo melhor e mais barato.
Gemini 3.5 Flash-Lite 🇺🇸 Google · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 145,1 26.º de 37 em pontuação · intervalo de confiança 142,5–146,7
Preço por milhão de tokens · combinado 0,76 € 3.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 83,3 %
SWE-bench Verified — não medido
FrontierMath 26,0 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 2.
Grok 4.6 🇺🇸 xAI · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 156,6 11.º de 37 em pontuação · intervalo de confiança 154,7–158,9
Preço por milhão de tokens · combinado 2,67 € 10.º de 16 em preço
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 94,0 %
SWE-bench Verified — não medido
FrontierMath 66,0 %
SimpleQA Verified 49,3 %
MATH Level 5 — não medido
Fora da linha de Pareto: superado em pontuação e em preço por 2.
Qwen3.7 Flash 🇨🇳 Alibaba · Pesos abertos: não · Licença: Proprietária
Ver todos os modelos Pontuação 144,6 27.º de 37 em pontuação · intervalo de confiança 142,4–147,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 82,3 %
SWE-bench Verified — não medido
FrontierMath 19,3 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Kimi K3 🇨🇳 Moonshot AI · Pesos abertos: sim · Licença: Kimi K3 license
Ver todos os modelos Pontuação 157,6 7.º de 37 em pontuação · intervalo de confiança 154,9–160,4
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 93,1 %
SWE-bench Verified — não medido
FrontierMath 72,2 %
SimpleQA Verified 50,6 %
MATH Level 5 — não medido
Recursos para o executar por si →
Kimi K2.7 Code 🇨🇳 Moonshot AI · Pesos abertos: sim · Licença: —
Ver todos os modelos Pontuação 150,0 20.º de 37 em pontuação · intervalo de confiança 148,1–151,8
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 87,9 %
SWE-bench Verified — não medido
FrontierMath 54,0 %
SimpleQA Verified 36,5 %
MATH Level 5 — não medido
Recursos para o executar por si →
Inkling 🇺🇸 Thinking Machines · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 148,6 22.º de 37 em pontuação · intervalo de confiança 145,7–150,6
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 88,3 %
SWE-bench Verified — não medido
FrontierMath 33,3 %
SimpleQA Verified 40,3 %
MATH Level 5 — não medido
Recursos para o executar por si →
Inkling Small 🇺🇸 Thinking Machines · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 150,2 19.º de 37 em pontuação · intervalo de confiança 147,5–152,1
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 88,5 %
SWE-bench Verified — não medido
FrontierMath 46,3 %
SimpleQA Verified 19,1 %
MATH Level 5 — não medido
Recursos para o executar por si →
Nemotron 3 Ultra 🇺🇸 Nvidia · Pesos abertos: sim · Licença: OpenMDW-1.1
Ver todos os modelos Pontuação 146,2 25.º de 37 em pontuação · intervalo de confiança 143,9–148,1
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 85,4 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Qwen3.6 35B-A3B 🇨🇳 Alibaba · Pesos abertos: sim · Licença: —
Ver todos os modelos Pontuação 143,9 28.º de 37 em pontuação · intervalo de confiança 141,2–146,0
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 84,8 %
SWE-bench Verified — não medido
FrontierMath 20,4 %
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Gemma 4 26B A4B 🇺🇸 Google · Pesos abertos: sim · Licença: Apache 2.0
Ver todos os modelos Pontuação 141,8 31.º de 37 em pontuação · intervalo de confiança 138,4–143,4
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 73,2 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Qwen3.5 9B 🇨🇳 Alibaba · Pesos abertos: sim · Licença: —
Ver todos os modelos Pontuação 139,5 34.º de 37 em pontuação · intervalo de confiança 136,4–141,3
Preço por milhão de tokens — Nenhum preço oficial publicado pelo editor: este modelo não está no gráfico.
Benchmarks (melhor resultado medido pela Epoch) GPQA Diamond 79,0 %
SWE-bench Verified — não medido
FrontierMath — não medido
SimpleQA Verified — não medido
MATH Level 5 — não medido
Recursos para o executar por si →
Modelo Editor Pesos abertos Licença Pontuação Preço entrada / saída Preço combinado GPQA Diamond Claude Opus 5.5 Pareto 🇺🇸 Anthropic não Proprietária 167,3 3,56 € / 17,82 € 7,13 € 90,6 % GPT-6 Astra 🇺🇸 OpenAI não Proprietária 166,5 8,91 € / 44,54 € 17,82 € 95,8 % Claude Sonnet 5.5 Pareto 🇺🇸 Anthropic não Proprietária 165,2 1,78 € / 8,91 € 3,56 € 95,6 % Claude Fable 5.1 🇺🇸 Anthropic não Proprietária 164,8 8,91 € / 44,54 € 17,82 € — GPT-5.6 Sol 🇺🇸 OpenAI não Proprietária 161,8 3,56 € / 17,82 € 7,13 € 93,5 % GPT-5.6 Terra 🇺🇸 OpenAI não Proprietária 159,8 não publicado — 93,3 % Kimi K3 🇨🇳 Moonshot AI sim Kimi K3 license 157,6 não publicado — 93,1 % Gemini 3.7 Flash Pareto 🇺🇸 Google não Proprietária 157,4 0,67 € / 3,34 € 1,34 € 94,8 % Gemini 3.8 Flash 🇺🇸 Google não Proprietária 156,9 0,67 € / 3,34 € 1,34 € 95,4 % Muse Spark 1.3 🇺🇸 Meta não Proprietária 156,9 não publicado — — Qwen3.8 Max 🇨🇳 Alibaba não Proprietária 156,6 não publicado — 92,7 % Grok 4.6 🇺🇸 xAI não Proprietária 156,6 1,78 € / 5,35 € 2,67 € 94,0 % GPT-5.6 Luna 🇺🇸 OpenAI não Proprietária 156,4 não publicado — 91,6 % GLM-5.3 🇨🇳 Z.ai sim MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 % DeepSeek V4 Pro 🇨🇳 DeepSeek sim MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 % DeepSeek V4.1 Flash Pareto 🇨🇳 DeepSeek sim MIT 155,0 0,27 € / 1,07 € 0,47 € — Grok 4.5 🇺🇸 xAI não Proprietária 154,0 1,78 € / 5,35 € 2,67 € 93,4 % GLM-5.3 Flash Pareto 🇨🇳 Z.ai sim MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 % Inkling Small 🇺🇸 Thinking Machines sim Apache 2.0 150,2 não publicado — 88,5 % Kimi K2.7 Code 🇨🇳 Moonshot AI sim — 150,0 não publicado — 87,9 % Qwen3.8 27B 🇨🇳 Alibaba sim Apache 2.0 149,4 não publicado — — Inkling 🇺🇸 Thinking Machines sim Apache 2.0 148,6 não publicado — 88,3 % MiniMax M3 🇨🇳 MiniMax sim MiniMax Community License 147,0 não publicado — 90,9 % Qwen3.5 397B 🇨🇳 Alibaba sim Apache 2.0 146,7 não publicado — 86,4 % Nemotron 3 Ultra 🇺🇸 Nvidia sim OpenMDW-1.1 146,2 não publicado — 85,4 % Gemini 3.5 Flash-Lite 🇺🇸 Google não Proprietária 145,1 0,27 € / 2,23 € 0,76 € 83,3 % Qwen3.7 Flash 🇨🇳 Alibaba não Proprietária 144,6 não publicado — 82,3 % Qwen3.6 35B-A3B 🇨🇳 Alibaba sim — 143,9 não publicado — 84,8 % Gemma 4 31B 🇺🇸 Google sim Apache 2.0 142,8 não publicado — 75,8 % Claude Haiku 4.5 🇺🇸 Anthropic não Proprietária 142,4 0,89 € / 4,45 € 1,78 € 71,2 % Gemma 4 26B A4B 🇺🇸 Google sim Apache 2.0 141,8 não publicado — 73,2 % Mistral Medium 3.5 🇫🇷 Mistral AI sim Modified MIT 141,4 1,34 € / 6,68 € 2,67 € — gpt-oss-120b 🇺🇸 OpenAI sim Apache 2.0 139,9 não publicado — 75,8 % Qwen3.5 9B 🇨🇳 Alibaba sim — 139,5 não publicado — 79,0 % gpt-oss-20b 🇺🇸 OpenAI sim Apache 2.0 137,8 não publicado — 60,8 % Llama 4 Maverick 🇺🇸 Meta sim Llama 4 132,2 não publicado — 67,0 % Mistral Small 3.2 🇫🇷 Mistral AI sim Apache 2.0 131,7 não publicado — 49,1 %
Método Pontuação: índice de capacidade da Epoch AI, que resume muitos benchmarks executados pela Epoch (GPQA, SWE-bench, FrontierMath…). Preço: tarifas oficiais dos editores, convertidas em euros à taxa do BCE; o preço combinado pondera a entrada em 3/4 e a saída em 1/4. Os modelos sem preço oficial estão na tabela, mas não no gráfico.
Fontes: Pontuações: Epoch AI, Capabilities & benchmarking (CC BY 4.0), até 2026-09-28 · Preços: páginas dos editores, verificadas em 2026-10-03 · Licenças: dataset Arena (CC BY 4.0) · Taxa do BCE de 2026-10-02: 1 € = 1,1225 $
Perguntas frequentes O que significa “pesos abertos”? Os pesos são os milhares de milhões de números que guardam o que um modelo aprendeu. Um modelo de pesos abertos pode ser descarregado e executado na sua própria máquina; um modelo fechado só está disponível através da API do seu editor. Pesos abertos não significa open source: a licença pode restringir a utilização.
Como se mede a inteligência dos modelos? Com o Epoch Capabilities Index (ECI) da Epoch AI, que combina os resultados de muitos benchmarks: raciocínio científico (GPQA Diamond), programação (SWE-bench Verified), matemática (FrontierMath), exatidão factual (SimpleQA Verified).
De onde vêm os preços? Das páginas oficiais de preços dos editores, em dólares por milhão de tokens, convertidos em euros à taxa de referência do Banco Central Europeu. O preço combinado conta 3/4 do preço de entrada e 1/4 do preço de saída.
O que é a linha de Pareto? Liga os modelos que nenhum outro modelo supera ao mesmo tempo em inteligência e em preço: os melhores compromissos neste momento.
Esta informação foi útil?