Besluta Rankning av AI-modeller: intelligens, benchmarks och pris Rankning av AI-modeller: intelligens, benchmarks och pris Varje punkt är en modell: ju högre upp, desto bättre rankad; ju längre till vänster, desto billigare. Klicka på en modell för att se den ensam.
Alla modeller Öppna vikter Endast API
Mest intressanta området 140 150 160 170 0,10 € 0,30 € 1,00 € 3,00 € 10,00 € 30,00 € Pris per miljon tokens (€, 3/4 in + 1/4 ut, logaritmisk skala) Epoch Capabilities Index (ECI) Claude Opus 5.5 (Anthropic) · Betyg 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Betyg 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Betyg 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Betyg 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Betyg 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Betyg 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Betyg 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Betyg 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Betyg 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Betyg 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Betyg 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Betyg 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Betyg 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Betyg 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Betyg 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Betyg 156,6 · 1,78 € / 5,35 € Grok 4.6 Öppna vikter Endast API Pareto-linje Claude Opus 5.5 🇺🇸 Anthropic · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 167,3 Nr 1 av 37 efter betyg · konfidensintervall 164,0–172,0
Pris per miljon tokens · sammanvägt 7,13 € Nr 13 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 90,6 %
SWE-bench Verified — ej uppmätt
FrontierMath 91,2 %
SimpleQA Verified 72,2 %
MATH Level 5 — ej uppmätt
På Pareto-linjen: ingen modell är både bättre och billigare.
Claude Sonnet 5.5 🇺🇸 Anthropic · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 165,2 Nr 3 av 37 efter betyg · konfidensintervall 161,8–169,4
Pris per miljon tokens · sammanvägt 3,56 € Nr 12 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 95,6 %
SWE-bench Verified — ej uppmätt
FrontierMath 88,8 %
SimpleQA Verified 46,5 %
MATH Level 5 — ej uppmätt
På Pareto-linjen: ingen modell är både bättre och billigare.
Claude Haiku 4.5 🇺🇸 Anthropic · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 142,4 Nr 30 av 37 efter betyg · konfidensintervall 139,5–144,3
Pris per miljon tokens · sammanvägt 1,78 € Nr 7 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 71,2 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified 13,2 %
MATH Level 5 96,4 %
Utanför Pareto-linjen: slagen på både betyg och pris av 6.
GPT-5.6 Sol 🇺🇸 OpenAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 161,8 Nr 5 av 37 efter betyg · konfidensintervall 159,3–165,3
Pris per miljon tokens · sammanvägt 7,13 € Nr 13 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 93,5 %
SWE-bench Verified — ej uppmätt
FrontierMath 89,1 %
SimpleQA Verified 69,7 %
MATH Level 5 — ej uppmätt
promotional price, at least until 11/21/2026
Utanför Pareto-linjen: slagen på både betyg och pris av 1.
GPT-5.6 Terra 🇺🇸 OpenAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 159,8 Nr 6 av 37 efter betyg · konfidensintervall 157,1–162,8
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 93,3 %
SWE-bench Verified — ej uppmätt
FrontierMath 86,0 %
SimpleQA Verified 43,2 %
MATH Level 5 — ej uppmätt
GPT-5.6 Luna 🇺🇸 OpenAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 156,4 Nr 13 av 37 efter betyg · konfidensintervall 154,1–158,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 91,6 %
SWE-bench Verified — ej uppmätt
FrontierMath 82,1 %
SimpleQA Verified 41,0 %
MATH Level 5 — ej uppmätt
Gemini 3.8 Flash 🇺🇸 Google · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 156,9 Nr 9 av 37 efter betyg · konfidensintervall 154,6–160,4
Pris per miljon tokens · sammanvägt 1,34 € Nr 4 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 95,4 %
SWE-bench Verified — ej uppmätt
FrontierMath 68,4 %
SimpleQA Verified 69,7 %
MATH Level 5 — ej uppmätt
until 12/31/2026, then $1.50 / $7.50
Utanför Pareto-linjen: slagen på både betyg och pris av 0.
Muse Spark 1.3 🇺🇸 Meta · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 156,9 Nr 9 av 37 efter betyg · konfidensintervall 154,7–159,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond — ej uppmätt
SWE-bench Verified — ej uppmätt
FrontierMath 74,4 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Grok 4.5 🇺🇸 xAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 154,0 Nr 17 av 37 efter betyg · konfidensintervall 152,3–156,1
Pris per miljon tokens · sammanvägt 2,67 € Nr 10 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 93,4 %
SWE-bench Verified — ej uppmätt
FrontierMath 57,2 %
SimpleQA Verified 48,3 %
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 5.
Qwen3.8 Max 🇨🇳 Alibaba · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 156,6 Nr 11 av 37 efter betyg · konfidensintervall 154,5–158,8
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 92,7 %
SWE-bench Verified — ej uppmätt
FrontierMath 74,7 %
SimpleQA Verified 45,8 %
MATH Level 5 — ej uppmätt
GLM-5.3 🇨🇳 Z.ai · Öppna vikter: ja · Licens: MIT
Visa alla modeller Betyg 155,8 Nr 14 av 37 efter betyg · konfidensintervall 153,7–158,3
Pris per miljon tokens · sammanvägt 1,92 € Nr 8 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — ej uppmätt
FrontierMath 68,8 %
SimpleQA Verified 41,0 %
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 2.
Resurser för att köra den själv →
GLM-5.3 Flash 🇨🇳 Z.ai · Öppna vikter: ja · Licens: MIT
Visa alla modeller Betyg 151,9 Nr 18 av 37 efter betyg · konfidensintervall 149,4–154,3
Pris per miljon tokens · sammanvägt 0,21 € Nr 1 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 90,2 %
SWE-bench Verified — ej uppmätt
FrontierMath 55,8 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
På Pareto-linjen: ingen modell är både bättre och billigare.
Resurser för att köra den själv →
DeepSeek V4.1 Flash 🇨🇳 DeepSeek · Öppna vikter: ja · Licens: MIT
Visa alla modeller Betyg 155,0 Nr 16 av 37 efter betyg · konfidensintervall 148,8–157,6
Pris per miljon tokens · sammanvägt 0,47 € Nr 2 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond — ej uppmätt
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
peak-hour price, half price off-peak
På Pareto-linjen: ingen modell är både bättre och billigare.
Resurser för att köra den själv →
DeepSeek V4 Pro 🇨🇳 DeepSeek · Öppna vikter: ja · Licens: MIT
Visa alla modeller Betyg 155,4 Nr 15 av 37 efter betyg · konfidensintervall 153,7–157,6
Pris per miljon tokens · sammanvägt 1,76 € Nr 6 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 91,7 %
SWE-bench Verified — ej uppmätt
FrontierMath 64,6 %
SimpleQA Verified 52,9 %
MATH Level 5 — ej uppmätt
peak-hour price, half price off-peak
Utanför Pareto-linjen: slagen på både betyg och pris av 2.
Resurser för att köra den själv →
Qwen3.8 27B 🇨🇳 Alibaba · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 149,4 Nr 21 av 37 efter betyg · konfidensintervall 147,4–151,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond — ej uppmätt
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Qwen3.5 397B 🇨🇳 Alibaba · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 146,7 Nr 24 av 37 efter betyg · konfidensintervall 144,8–148,2
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 86,4 %
SWE-bench Verified — ej uppmätt
FrontierMath 31,2 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
MiniMax M3 🇨🇳 MiniMax · Öppna vikter: ja · Licens: MiniMax Community License
Visa alla modeller Betyg 147,0 Nr 23 av 37 efter betyg · konfidensintervall 142,7–149,8
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Gemma 4 31B 🇺🇸 Google · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 142,8 Nr 29 av 37 efter betyg · konfidensintervall 140,3–144,9
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified 10,4 %
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Mistral Medium 3.5 🇫🇷 Mistral AI · Öppna vikter: ja · Licens: Modified MIT
Visa alla modeller Betyg 141,4 Nr 32 av 37 efter betyg · konfidensintervall 138,4–143,7
Pris per miljon tokens · sammanvägt 2,67 € Nr 9 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond — ej uppmätt
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 8.
Resurser för att köra den själv →
Mistral Small 3.2 🇫🇷 Mistral AI · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 131,7 Nr 37 av 37 efter betyg · konfidensintervall 126,6–133,9
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 49,1 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
gpt-oss-120b 🇺🇸 OpenAI · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 139,9 Nr 33 av 37 efter betyg · konfidensintervall 135,3–142,3
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
gpt-oss-20b 🇺🇸 OpenAI · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 137,8 Nr 35 av 37 efter betyg · konfidensintervall 133,0–139,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 60,8 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Llama 4 Maverick 🇺🇸 Meta · Öppna vikter: ja · Licens: Llama 4
Visa alla modeller Betyg 132,2 Nr 36 av 37 efter betyg · konfidensintervall 128,0–134,1
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 67,0 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 73,0 %
Resurser för att köra den själv →
GPT-6 Astra 🇺🇸 OpenAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 166,5 Nr 2 av 37 efter betyg · konfidensintervall 163,1–171,1
Pris per miljon tokens · sammanvägt 17,82 € Nr 15 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 95,8 %
SWE-bench Verified — ej uppmätt
FrontierMath 93,7 %
SimpleQA Verified 75,6 %
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 1.
Claude Fable 5.1 🇺🇸 Anthropic · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 164,8 Nr 4 av 37 efter betyg · konfidensintervall 161,8–169,1
Pris per miljon tokens · sammanvägt 17,82 € Nr 15 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond — ej uppmätt
SWE-bench Verified — ej uppmätt
FrontierMath 90,2 %
SimpleQA Verified 70,8 %
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 2.
Gemini 3.7 Flash 🇺🇸 Google · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 157,4 Nr 8 av 37 efter betyg · konfidensintervall 155,4–160,1
Pris per miljon tokens · sammanvägt 1,34 € Nr 4 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 94,8 %
SWE-bench Verified — ej uppmätt
FrontierMath 71,6 %
SimpleQA Verified 69,2 %
MATH Level 5 — ej uppmätt
until 12/31/2026, then $1.50 / $7.50
På Pareto-linjen: ingen modell är både bättre och billigare.
Gemini 3.5 Flash-Lite 🇺🇸 Google · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 145,1 Nr 26 av 37 efter betyg · konfidensintervall 142,5–146,7
Pris per miljon tokens · sammanvägt 0,76 € Nr 3 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 83,3 %
SWE-bench Verified — ej uppmätt
FrontierMath 26,0 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 2.
Grok 4.6 🇺🇸 xAI · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 156,6 Nr 11 av 37 efter betyg · konfidensintervall 154,7–158,9
Pris per miljon tokens · sammanvägt 2,67 € Nr 10 av 16 efter pris
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 94,0 %
SWE-bench Verified — ej uppmätt
FrontierMath 66,0 %
SimpleQA Verified 49,3 %
MATH Level 5 — ej uppmätt
Utanför Pareto-linjen: slagen på både betyg och pris av 2.
Qwen3.7 Flash 🇨🇳 Alibaba · Öppna vikter: nej · Licens: Proprietär
Visa alla modeller Betyg 144,6 Nr 27 av 37 efter betyg · konfidensintervall 142,4–147,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 82,3 %
SWE-bench Verified — ej uppmätt
FrontierMath 19,3 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Kimi K3 🇨🇳 Moonshot AI · Öppna vikter: ja · Licens: Kimi K3 license
Visa alla modeller Betyg 157,6 Nr 7 av 37 efter betyg · konfidensintervall 154,9–160,4
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 93,1 %
SWE-bench Verified — ej uppmätt
FrontierMath 72,2 %
SimpleQA Verified 50,6 %
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Kimi K2.7 Code 🇨🇳 Moonshot AI · Öppna vikter: ja · Licens: —
Visa alla modeller Betyg 150,0 Nr 20 av 37 efter betyg · konfidensintervall 148,1–151,8
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 87,9 %
SWE-bench Verified — ej uppmätt
FrontierMath 54,0 %
SimpleQA Verified 36,5 %
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Inkling 🇺🇸 Thinking Machines · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 148,6 Nr 22 av 37 efter betyg · konfidensintervall 145,7–150,6
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 88,3 %
SWE-bench Verified — ej uppmätt
FrontierMath 33,3 %
SimpleQA Verified 40,3 %
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Inkling Small 🇺🇸 Thinking Machines · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 150,2 Nr 19 av 37 efter betyg · konfidensintervall 147,5–152,1
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 88,5 %
SWE-bench Verified — ej uppmätt
FrontierMath 46,3 %
SimpleQA Verified 19,1 %
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Nemotron 3 Ultra 🇺🇸 Nvidia · Öppna vikter: ja · Licens: OpenMDW-1.1
Visa alla modeller Betyg 146,2 Nr 25 av 37 efter betyg · konfidensintervall 143,9–148,1
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 85,4 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Qwen3.6 35B-A3B 🇨🇳 Alibaba · Öppna vikter: ja · Licens: —
Visa alla modeller Betyg 143,9 Nr 28 av 37 efter betyg · konfidensintervall 141,2–146,0
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 84,8 %
SWE-bench Verified — ej uppmätt
FrontierMath 20,4 %
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Gemma 4 26B A4B 🇺🇸 Google · Öppna vikter: ja · Licens: Apache 2.0
Visa alla modeller Betyg 141,8 Nr 31 av 37 efter betyg · konfidensintervall 138,4–143,4
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 73,2 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Qwen3.5 9B 🇨🇳 Alibaba · Öppna vikter: ja · Licens: —
Visa alla modeller Betyg 139,5 Nr 34 av 37 efter betyg · konfidensintervall 136,4–141,3
Pris per miljon tokens — Inget officiellt pris publicerat av utgivaren: modellen finns inte i diagrammet.
Benchmarks (bästa resultat uppmätt av Epoch) GPQA Diamond 79,0 %
SWE-bench Verified — ej uppmätt
FrontierMath — ej uppmätt
SimpleQA Verified — ej uppmätt
MATH Level 5 — ej uppmätt
Resurser för att köra den själv →
Modell Utgivare Öppna vikter Licens Betyg Pris in / ut Sammanvägt pris GPQA Diamond Claude Opus 5.5 Pareto 🇺🇸 Anthropic nej Proprietär 167,3 3,56 € / 17,82 € 7,13 € 90,6 % GPT-6 Astra 🇺🇸 OpenAI nej Proprietär 166,5 8,91 € / 44,54 € 17,82 € 95,8 % Claude Sonnet 5.5 Pareto 🇺🇸 Anthropic nej Proprietär 165,2 1,78 € / 8,91 € 3,56 € 95,6 % Claude Fable 5.1 🇺🇸 Anthropic nej Proprietär 164,8 8,91 € / 44,54 € 17,82 € — GPT-5.6 Sol 🇺🇸 OpenAI nej Proprietär 161,8 3,56 € / 17,82 € 7,13 € 93,5 % GPT-5.6 Terra 🇺🇸 OpenAI nej Proprietär 159,8 ej publicerat — 93,3 % Kimi K3 🇨🇳 Moonshot AI ja Kimi K3 license 157,6 ej publicerat — 93,1 % Gemini 3.7 Flash Pareto 🇺🇸 Google nej Proprietär 157,4 0,67 € / 3,34 € 1,34 € 94,8 % Gemini 3.8 Flash 🇺🇸 Google nej Proprietär 156,9 0,67 € / 3,34 € 1,34 € 95,4 % Muse Spark 1.3 🇺🇸 Meta nej Proprietär 156,9 ej publicerat — — Qwen3.8 Max 🇨🇳 Alibaba nej Proprietär 156,6 ej publicerat — 92,7 % Grok 4.6 🇺🇸 xAI nej Proprietär 156,6 1,78 € / 5,35 € 2,67 € 94,0 % GPT-5.6 Luna 🇺🇸 OpenAI nej Proprietär 156,4 ej publicerat — 91,6 % GLM-5.3 🇨🇳 Z.ai ja MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 % DeepSeek V4 Pro 🇨🇳 DeepSeek ja MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 % DeepSeek V4.1 Flash Pareto 🇨🇳 DeepSeek ja MIT 155,0 0,27 € / 1,07 € 0,47 € — Grok 4.5 🇺🇸 xAI nej Proprietär 154,0 1,78 € / 5,35 € 2,67 € 93,4 % GLM-5.3 Flash Pareto 🇨🇳 Z.ai ja MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 % Inkling Small 🇺🇸 Thinking Machines ja Apache 2.0 150,2 ej publicerat — 88,5 % Kimi K2.7 Code 🇨🇳 Moonshot AI ja — 150,0 ej publicerat — 87,9 % Qwen3.8 27B 🇨🇳 Alibaba ja Apache 2.0 149,4 ej publicerat — — Inkling 🇺🇸 Thinking Machines ja Apache 2.0 148,6 ej publicerat — 88,3 % MiniMax M3 🇨🇳 MiniMax ja MiniMax Community License 147,0 ej publicerat — 90,9 % Qwen3.5 397B 🇨🇳 Alibaba ja Apache 2.0 146,7 ej publicerat — 86,4 % Nemotron 3 Ultra 🇺🇸 Nvidia ja OpenMDW-1.1 146,2 ej publicerat — 85,4 % Gemini 3.5 Flash-Lite 🇺🇸 Google nej Proprietär 145,1 0,27 € / 2,23 € 0,76 € 83,3 % Qwen3.7 Flash 🇨🇳 Alibaba nej Proprietär 144,6 ej publicerat — 82,3 % Qwen3.6 35B-A3B 🇨🇳 Alibaba ja — 143,9 ej publicerat — 84,8 % Gemma 4 31B 🇺🇸 Google ja Apache 2.0 142,8 ej publicerat — 75,8 % Claude Haiku 4.5 🇺🇸 Anthropic nej Proprietär 142,4 0,89 € / 4,45 € 1,78 € 71,2 % Gemma 4 26B A4B 🇺🇸 Google ja Apache 2.0 141,8 ej publicerat — 73,2 % Mistral Medium 3.5 🇫🇷 Mistral AI ja Modified MIT 141,4 1,34 € / 6,68 € 2,67 € — gpt-oss-120b 🇺🇸 OpenAI ja Apache 2.0 139,9 ej publicerat — 75,8 % Qwen3.5 9B 🇨🇳 Alibaba ja — 139,5 ej publicerat — 79,0 % gpt-oss-20b 🇺🇸 OpenAI ja Apache 2.0 137,8 ej publicerat — 60,8 % Llama 4 Maverick 🇺🇸 Meta ja Llama 4 132,2 ej publicerat — 67,0 % Mistral Small 3.2 🇫🇷 Mistral AI ja Apache 2.0 131,7 ej publicerat — 49,1 %
Vanliga frågor Vad betyder ”öppna vikter”? Vikterna är de miljarder tal som innehåller det en modell har lärt sig. En modell med öppna vikter kan laddas ner och köras på din egen maskin; en stängd modell finns bara via utgivarens API. Öppna vikter betyder inte öppen källkod: licensen kan begränsa användningen.
Hur mäts modellernas intelligens? Med Epoch AI:s Capabilities Index (ECI), som kombinerar resultaten från många benchmarks: vetenskapligt resonerande (GPQA Diamond), programmering (SWE-bench Verified), matematik (FrontierMath), faktamässig korrekthet (SimpleQA Verified).
Var kommer priserna ifrån? Från utgivarnas officiella prissidor, i dollar per miljon tokens, omräknade till euro enligt Europeiska centralbankens referenskurs. Det sammanvägda priset räknar 3/4 av inpriset och 1/4 av utpriset.
Vad är Pareto-linjen? Den förbinder de modeller som ingen annan modell slår på både intelligens och pris: de bästa kompromisserna just nu.
Var den här informationen användbar?