Beslissen Ranglijst van AI-modellen: intelligentie, benchmarks en prijs Ranglijst van AI-modellen: intelligentie, benchmarks en prijs Elke stip is een model: hoe hoger, hoe beter het scoort; hoe verder naar links, hoe goedkoper. Klik op een model om het apart te bekijken.
Alle modellen Open gewichten Alleen API
Interessantste zone 140 150 160 170 € 0,10 € 0,30 € 1,00 € 3,00 € 10,00 € 30,00 Prijs per miljoen tokens (€, 3/4 invoer + 1/4 uitvoer, logaritmische schaal) Epoch Capabilities Index (ECI) Claude Opus 5.5 (Anthropic) · Score 167,3 · € 3,56 / € 17,82 Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Score 165,2 · € 1,78 / € 8,91 Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Score 142,4 · € 0,89 / € 4,45 Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Score 161,8 · € 3,56 / € 17,82 GPT-5.6 Sol Gemini 3.8 Flash (Google) · Score 156,9 · € 0,67 / € 3,34 Gemini 3.8 Flash Grok 4.5 (xAI) · Score 154,0 · € 1,78 / € 5,35 Grok 4.5 GLM-5.3 (Z.ai) · Score 155,8 · € 1,25 / € 3,92 GLM-5.3 GLM-5.3 Flash (Z.ai) · Score 151,9 · € 0,13 / € 0,45 GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Score 155,0 · € 0,27 / € 1,07 DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Score 155,4 · € 1,18 / € 3,53 DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Score 141,4 · € 1,34 / € 6,68 Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Score 166,5 · € 8,91 / € 44,54 GPT-6 Astra Claude Fable 5.1 (Anthropic) · Score 164,8 · € 8,91 / € 44,54 Claude Fable 5.1 Gemini 3.7 Flash (Google) · Score 157,4 · € 0,67 / € 3,34 Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Score 145,1 · € 0,27 / € 2,23 Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Score 156,6 · € 1,78 / € 5,35 Grok 4.6 Open gewichten Alleen API Pareto-lijn Claude Opus 5.5 🇺🇸 Anthropic · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 167,3 #1 van 37 op score · betrouwbaarheidsinterval 164,0–172,0
Prijs per miljoen tokens · gemengd € 7,13 #13 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 90,6 %
SWE-bench Verified — niet gemeten
FrontierMath 91,2 %
SimpleQA Verified 72,2 %
MATH Level 5 — niet gemeten
Op de Pareto-lijn: geen enkel model is tegelijk beter en goedkoper.
Claude Sonnet 5.5 🇺🇸 Anthropic · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 165,2 #3 van 37 op score · betrouwbaarheidsinterval 161,8–169,4
Prijs per miljoen tokens · gemengd € 3,56 #12 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 95,6 %
SWE-bench Verified — niet gemeten
FrontierMath 88,8 %
SimpleQA Verified 46,5 %
MATH Level 5 — niet gemeten
Op de Pareto-lijn: geen enkel model is tegelijk beter en goedkoper.
Claude Haiku 4.5 🇺🇸 Anthropic · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 142,4 #30 van 37 op score · betrouwbaarheidsinterval 139,5–144,3
Prijs per miljoen tokens · gemengd € 1,78 #7 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 71,2 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified 13,2 %
MATH Level 5 96,4 %
Buiten de Pareto-lijn: op score én prijs verslagen door 6.
GPT-5.6 Sol 🇺🇸 OpenAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 161,8 #5 van 37 op score · betrouwbaarheidsinterval 159,3–165,3
Prijs per miljoen tokens · gemengd € 7,13 #13 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 93,5 %
SWE-bench Verified — niet gemeten
FrontierMath 89,1 %
SimpleQA Verified 69,7 %
MATH Level 5 — niet gemeten
promotional price, at least until 11/21/2026
Buiten de Pareto-lijn: op score én prijs verslagen door 1.
GPT-5.6 Terra 🇺🇸 OpenAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 159,8 #6 van 37 op score · betrouwbaarheidsinterval 157,1–162,8
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 93,3 %
SWE-bench Verified — niet gemeten
FrontierMath 86,0 %
SimpleQA Verified 43,2 %
MATH Level 5 — niet gemeten
GPT-5.6 Luna 🇺🇸 OpenAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 156,4 #13 van 37 op score · betrouwbaarheidsinterval 154,1–158,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 91,6 %
SWE-bench Verified — niet gemeten
FrontierMath 82,1 %
SimpleQA Verified 41,0 %
MATH Level 5 — niet gemeten
Gemini 3.8 Flash 🇺🇸 Google · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 156,9 #9 van 37 op score · betrouwbaarheidsinterval 154,6–160,4
Prijs per miljoen tokens · gemengd € 1,34 #4 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 95,4 %
SWE-bench Verified — niet gemeten
FrontierMath 68,4 %
SimpleQA Verified 69,7 %
MATH Level 5 — niet gemeten
until 12/31/2026, then $1.50 / $7.50
Buiten de Pareto-lijn: op score én prijs verslagen door 0.
Muse Spark 1.3 🇺🇸 Meta · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 156,9 #9 van 37 op score · betrouwbaarheidsinterval 154,7–159,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond — niet gemeten
SWE-bench Verified — niet gemeten
FrontierMath 74,4 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Grok 4.5 🇺🇸 xAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 154,0 #17 van 37 op score · betrouwbaarheidsinterval 152,3–156,1
Prijs per miljoen tokens · gemengd € 2,67 #10 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 93,4 %
SWE-bench Verified — niet gemeten
FrontierMath 57,2 %
SimpleQA Verified 48,3 %
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 5.
Qwen3.8 Max 🇨🇳 Alibaba · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 156,6 #11 van 37 op score · betrouwbaarheidsinterval 154,5–158,8
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 92,7 %
SWE-bench Verified — niet gemeten
FrontierMath 74,7 %
SimpleQA Verified 45,8 %
MATH Level 5 — niet gemeten
GLM-5.3 🇨🇳 Z.ai · Open gewichten: ja · Licentie: MIT
Bekijk alle modellen Score 155,8 #14 van 37 op score · betrouwbaarheidsinterval 153,7–158,3
Prijs per miljoen tokens · gemengd € 1,92 #8 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — niet gemeten
FrontierMath 68,8 %
SimpleQA Verified 41,0 %
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 2.
Resources om het zelf te draaien →
GLM-5.3 Flash 🇨🇳 Z.ai · Open gewichten: ja · Licentie: MIT
Bekijk alle modellen Score 151,9 #18 van 37 op score · betrouwbaarheidsinterval 149,4–154,3
Prijs per miljoen tokens · gemengd € 0,21 #1 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 90,2 %
SWE-bench Verified — niet gemeten
FrontierMath 55,8 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Op de Pareto-lijn: geen enkel model is tegelijk beter en goedkoper.
Resources om het zelf te draaien →
DeepSeek V4.1 Flash 🇨🇳 DeepSeek · Open gewichten: ja · Licentie: MIT
Bekijk alle modellen Score 155,0 #16 van 37 op score · betrouwbaarheidsinterval 148,8–157,6
Prijs per miljoen tokens · gemengd € 0,47 #2 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond — niet gemeten
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
peak-hour price, half price off-peak
Op de Pareto-lijn: geen enkel model is tegelijk beter en goedkoper.
Resources om het zelf te draaien →
DeepSeek V4 Pro 🇨🇳 DeepSeek · Open gewichten: ja · Licentie: MIT
Bekijk alle modellen Score 155,4 #15 van 37 op score · betrouwbaarheidsinterval 153,7–157,6
Prijs per miljoen tokens · gemengd € 1,76 #6 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 91,7 %
SWE-bench Verified — niet gemeten
FrontierMath 64,6 %
SimpleQA Verified 52,9 %
MATH Level 5 — niet gemeten
peak-hour price, half price off-peak
Buiten de Pareto-lijn: op score én prijs verslagen door 2.
Resources om het zelf te draaien →
Qwen3.8 27B 🇨🇳 Alibaba · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 149,4 #21 van 37 op score · betrouwbaarheidsinterval 147,4–151,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond — niet gemeten
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Qwen3.5 397B 🇨🇳 Alibaba · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 146,7 #24 van 37 op score · betrouwbaarheidsinterval 144,8–148,2
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 86,4 %
SWE-bench Verified — niet gemeten
FrontierMath 31,2 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
MiniMax M3 🇨🇳 MiniMax · Open gewichten: ja · Licentie: MiniMax Community License
Bekijk alle modellen Score 147,0 #23 van 37 op score · betrouwbaarheidsinterval 142,7–149,8
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Gemma 4 31B 🇺🇸 Google · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 142,8 #29 van 37 op score · betrouwbaarheidsinterval 140,3–144,9
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified 10,4 %
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Mistral Medium 3.5 🇫🇷 Mistral AI · Open gewichten: ja · Licentie: Modified MIT
Bekijk alle modellen Score 141,4 #32 van 37 op score · betrouwbaarheidsinterval 138,4–143,7
Prijs per miljoen tokens · gemengd € 2,67 #9 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond — niet gemeten
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 8.
Resources om het zelf te draaien →
Mistral Small 3.2 🇫🇷 Mistral AI · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 131,7 #37 van 37 op score · betrouwbaarheidsinterval 126,6–133,9
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 49,1 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
gpt-oss-120b 🇺🇸 OpenAI · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 139,9 #33 van 37 op score · betrouwbaarheidsinterval 135,3–142,3
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
gpt-oss-20b 🇺🇸 OpenAI · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 137,8 #35 van 37 op score · betrouwbaarheidsinterval 133,0–139,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 60,8 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Llama 4 Maverick 🇺🇸 Meta · Open gewichten: ja · Licentie: Llama 4
Bekijk alle modellen Score 132,2 #36 van 37 op score · betrouwbaarheidsinterval 128,0–134,1
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 67,0 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 73,0 %
Resources om het zelf te draaien →
GPT-6 Astra 🇺🇸 OpenAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 166,5 #2 van 37 op score · betrouwbaarheidsinterval 163,1–171,1
Prijs per miljoen tokens · gemengd € 17,82 #15 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 95,8 %
SWE-bench Verified — niet gemeten
FrontierMath 93,7 %
SimpleQA Verified 75,6 %
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 1.
Claude Fable 5.1 🇺🇸 Anthropic · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 164,8 #4 van 37 op score · betrouwbaarheidsinterval 161,8–169,1
Prijs per miljoen tokens · gemengd € 17,82 #15 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond — niet gemeten
SWE-bench Verified — niet gemeten
FrontierMath 90,2 %
SimpleQA Verified 70,8 %
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 2.
Gemini 3.7 Flash 🇺🇸 Google · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 157,4 #8 van 37 op score · betrouwbaarheidsinterval 155,4–160,1
Prijs per miljoen tokens · gemengd € 1,34 #4 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 94,8 %
SWE-bench Verified — niet gemeten
FrontierMath 71,6 %
SimpleQA Verified 69,2 %
MATH Level 5 — niet gemeten
until 12/31/2026, then $1.50 / $7.50
Op de Pareto-lijn: geen enkel model is tegelijk beter en goedkoper.
Gemini 3.5 Flash-Lite 🇺🇸 Google · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 145,1 #26 van 37 op score · betrouwbaarheidsinterval 142,5–146,7
Prijs per miljoen tokens · gemengd € 0,76 #3 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 83,3 %
SWE-bench Verified — niet gemeten
FrontierMath 26,0 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 2.
Grok 4.6 🇺🇸 xAI · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 156,6 #11 van 37 op score · betrouwbaarheidsinterval 154,7–158,9
Prijs per miljoen tokens · gemengd € 2,67 #10 van 16 op prijs
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 94,0 %
SWE-bench Verified — niet gemeten
FrontierMath 66,0 %
SimpleQA Verified 49,3 %
MATH Level 5 — niet gemeten
Buiten de Pareto-lijn: op score én prijs verslagen door 2.
Qwen3.7 Flash 🇨🇳 Alibaba · Open gewichten: nee · Licentie: Propriëtair
Bekijk alle modellen Score 144,6 #27 van 37 op score · betrouwbaarheidsinterval 142,4–147,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 82,3 %
SWE-bench Verified — niet gemeten
FrontierMath 19,3 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Kimi K3 🇨🇳 Moonshot AI · Open gewichten: ja · Licentie: Kimi K3 license
Bekijk alle modellen Score 157,6 #7 van 37 op score · betrouwbaarheidsinterval 154,9–160,4
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 93,1 %
SWE-bench Verified — niet gemeten
FrontierMath 72,2 %
SimpleQA Verified 50,6 %
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Kimi K2.7 Code 🇨🇳 Moonshot AI · Open gewichten: ja · Licentie: —
Bekijk alle modellen Score 150,0 #20 van 37 op score · betrouwbaarheidsinterval 148,1–151,8
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 87,9 %
SWE-bench Verified — niet gemeten
FrontierMath 54,0 %
SimpleQA Verified 36,5 %
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Inkling 🇺🇸 Thinking Machines · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 148,6 #22 van 37 op score · betrouwbaarheidsinterval 145,7–150,6
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 88,3 %
SWE-bench Verified — niet gemeten
FrontierMath 33,3 %
SimpleQA Verified 40,3 %
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Inkling Small 🇺🇸 Thinking Machines · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 150,2 #19 van 37 op score · betrouwbaarheidsinterval 147,5–152,1
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 88,5 %
SWE-bench Verified — niet gemeten
FrontierMath 46,3 %
SimpleQA Verified 19,1 %
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Nemotron 3 Ultra 🇺🇸 Nvidia · Open gewichten: ja · Licentie: OpenMDW-1.1
Bekijk alle modellen Score 146,2 #25 van 37 op score · betrouwbaarheidsinterval 143,9–148,1
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 85,4 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Qwen3.6 35B-A3B 🇨🇳 Alibaba · Open gewichten: ja · Licentie: —
Bekijk alle modellen Score 143,9 #28 van 37 op score · betrouwbaarheidsinterval 141,2–146,0
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 84,8 %
SWE-bench Verified — niet gemeten
FrontierMath 20,4 %
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Gemma 4 26B A4B 🇺🇸 Google · Open gewichten: ja · Licentie: Apache 2.0
Bekijk alle modellen Score 141,8 #31 van 37 op score · betrouwbaarheidsinterval 138,4–143,4
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 73,2 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Qwen3.5 9B 🇨🇳 Alibaba · Open gewichten: ja · Licentie: —
Bekijk alle modellen Score 139,5 #34 van 37 op score · betrouwbaarheidsinterval 136,4–141,3
Prijs per miljoen tokens — Geen officiële prijs gepubliceerd door de ontwikkelaar: dit model staat niet in de grafiek.
Benchmarks (beste resultaat gemeten door Epoch) GPQA Diamond 79,0 %
SWE-bench Verified — niet gemeten
FrontierMath — niet gemeten
SimpleQA Verified — niet gemeten
MATH Level 5 — niet gemeten
Resources om het zelf te draaien →
Model Ontwikkelaar Open gewichten Licentie Score Prijs invoer / uitvoer Gemengde prijs GPQA Diamond Claude Opus 5.5 Pareto 🇺🇸 Anthropic nee Propriëtair 167,3 € 3,56 / € 17,82 € 7,13 90,6 % GPT-6 Astra 🇺🇸 OpenAI nee Propriëtair 166,5 € 8,91 / € 44,54 € 17,82 95,8 % Claude Sonnet 5.5 Pareto 🇺🇸 Anthropic nee Propriëtair 165,2 € 1,78 / € 8,91 € 3,56 95,6 % Claude Fable 5.1 🇺🇸 Anthropic nee Propriëtair 164,8 € 8,91 / € 44,54 € 17,82 — GPT-5.6 Sol 🇺🇸 OpenAI nee Propriëtair 161,8 € 3,56 / € 17,82 € 7,13 93,5 % GPT-5.6 Terra 🇺🇸 OpenAI nee Propriëtair 159,8 niet gepubliceerd — 93,3 % Kimi K3 🇨🇳 Moonshot AI ja Kimi K3 license 157,6 niet gepubliceerd — 93,1 % Gemini 3.7 Flash Pareto 🇺🇸 Google nee Propriëtair 157,4 € 0,67 / € 3,34 € 1,34 94,8 % Gemini 3.8 Flash 🇺🇸 Google nee Propriëtair 156,9 € 0,67 / € 3,34 € 1,34 95,4 % Muse Spark 1.3 🇺🇸 Meta nee Propriëtair 156,9 niet gepubliceerd — — Qwen3.8 Max 🇨🇳 Alibaba nee Propriëtair 156,6 niet gepubliceerd — 92,7 % Grok 4.6 🇺🇸 xAI nee Propriëtair 156,6 € 1,78 / € 5,35 € 2,67 94,0 % GPT-5.6 Luna 🇺🇸 OpenAI nee Propriëtair 156,4 niet gepubliceerd — 91,6 % GLM-5.3 🇨🇳 Z.ai ja MIT 155,8 € 1,25 / € 3,92 € 1,92 90,9 % DeepSeek V4 Pro 🇨🇳 DeepSeek ja MIT 155,4 € 1,18 / € 3,53 € 1,76 91,7 % DeepSeek V4.1 Flash Pareto 🇨🇳 DeepSeek ja MIT 155,0 € 0,27 / € 1,07 € 0,47 — Grok 4.5 🇺🇸 xAI nee Propriëtair 154,0 € 1,78 / € 5,35 € 2,67 93,4 % GLM-5.3 Flash Pareto 🇨🇳 Z.ai ja MIT 151,9 € 0,13 / € 0,45 € 0,21 90,2 % Inkling Small 🇺🇸 Thinking Machines ja Apache 2.0 150,2 niet gepubliceerd — 88,5 % Kimi K2.7 Code 🇨🇳 Moonshot AI ja — 150,0 niet gepubliceerd — 87,9 % Qwen3.8 27B 🇨🇳 Alibaba ja Apache 2.0 149,4 niet gepubliceerd — — Inkling 🇺🇸 Thinking Machines ja Apache 2.0 148,6 niet gepubliceerd — 88,3 % MiniMax M3 🇨🇳 MiniMax ja MiniMax Community License 147,0 niet gepubliceerd — 90,9 % Qwen3.5 397B 🇨🇳 Alibaba ja Apache 2.0 146,7 niet gepubliceerd — 86,4 % Nemotron 3 Ultra 🇺🇸 Nvidia ja OpenMDW-1.1 146,2 niet gepubliceerd — 85,4 % Gemini 3.5 Flash-Lite 🇺🇸 Google nee Propriëtair 145,1 € 0,27 / € 2,23 € 0,76 83,3 % Qwen3.7 Flash 🇨🇳 Alibaba nee Propriëtair 144,6 niet gepubliceerd — 82,3 % Qwen3.6 35B-A3B 🇨🇳 Alibaba ja — 143,9 niet gepubliceerd — 84,8 % Gemma 4 31B 🇺🇸 Google ja Apache 2.0 142,8 niet gepubliceerd — 75,8 % Claude Haiku 4.5 🇺🇸 Anthropic nee Propriëtair 142,4 € 0,89 / € 4,45 € 1,78 71,2 % Gemma 4 26B A4B 🇺🇸 Google ja Apache 2.0 141,8 niet gepubliceerd — 73,2 % Mistral Medium 3.5 🇫🇷 Mistral AI ja Modified MIT 141,4 € 1,34 / € 6,68 € 2,67 — gpt-oss-120b 🇺🇸 OpenAI ja Apache 2.0 139,9 niet gepubliceerd — 75,8 % Qwen3.5 9B 🇨🇳 Alibaba ja — 139,5 niet gepubliceerd — 79,0 % gpt-oss-20b 🇺🇸 OpenAI ja Apache 2.0 137,8 niet gepubliceerd — 60,8 % Llama 4 Maverick 🇺🇸 Meta ja Llama 4 132,2 niet gepubliceerd — 67,0 % Mistral Small 3.2 🇫🇷 Mistral AI ja Apache 2.0 131,7 niet gepubliceerd — 49,1 %
Methode Score: de capaciteitsindex van Epoch AI, die veel door Epoch uitgevoerde benchmarks samenvat (GPQA, SWE-bench, FrontierMath…). Prijs: officiële tarieven van de ontwikkelaars, omgerekend naar euro tegen de ECB-koers; de gemengde prijs telt de invoer voor 3/4 en de uitvoer voor 1/4. Modellen zonder officiële prijs staan in de tabel, maar niet in de grafiek.
Bronnen: Scores: Epoch AI, Capabilities & benchmarking (CC BY 4.0), tot 2026-09-28 · Prijzen: pagina's van de ontwikkelaars, gecontroleerd op 2026-10-03 · Licenties: Arena-dataset (CC BY 4.0) · ECB-koers van 2026-10-02: € 1 = $ 1,1225
Veelgestelde vragen Wat betekent “open gewichten”? Gewichten zijn de miljarden getallen waarin opgeslagen ligt wat een model heeft geleerd. Een model met open gewichten kun je downloaden en op je eigen machine draaien; een gesloten model is alleen beschikbaar via de API van de ontwikkelaar. Open gewichten betekent niet open source: de licentie kan het gebruik beperken.
Hoe wordt de intelligentie van een model gemeten? Met de Capabilities Index (ECI) van Epoch AI, die de resultaten van veel benchmarks combineert: wetenschappelijk redeneren (GPQA Diamond), programmeren (SWE-bench Verified), wiskunde (FrontierMath), feitelijke juistheid (SimpleQA Verified).
Waar komen de prijzen vandaan? Van de officiële prijspagina's van de ontwikkelaars, in dollar per miljoen tokens, omgerekend naar euro tegen de referentiekoers van de Europese Centrale Bank. De gemengde prijs telt voor 3/4 de invoerprijs en voor 1/4 de uitvoerprijs.
Wat is de Pareto-lijn? Die verbindt de modellen die door geen enkel ander model tegelijk op intelligentie en prijs worden verslagen: de beste compromissen op dit moment.
Was deze informatie nuttig?