Décider Classement des modèles IA : intelligence, benchmarks et prix Classement des modèles IA : intelligence, benchmarks et prix Chaque point est un modèle : plus il est haut, mieux il est classé ; plus il est à gauche, moins il coûte. Cliquez sur un modèle pour ne voir que lui.
Tous les modèles Poids ouverts API seulement
Zone la plus intéressante 140 150 160 170 0,10 € 0,30 € 1,00 € 3,00 € 10,00 € 30,00 € Prix par million de tokens (€, 3/4 entrée + 1/4 sortie, échelle log) Indice de capacités Epoch (ECI) Claude Opus 5.5 (Anthropic) · Score 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Score 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Score 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Score 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Score 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Score 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Score 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Score 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Score 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Score 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Score 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Score 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Score 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Score 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Score 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Score 156,6 · 1,78 € / 5,35 € Grok 4.6 Poids ouverts API seulement Ligne de Pareto Claude Opus 5.5 🇺🇸 Anthropic · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 167,3 1e sur 37 en score · intervalle de confiance 164,0–172,0
Prix par million de tokens · mixte 7,13 € 13e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 90,6 %
SWE-bench Verified — non mesuré
FrontierMath 91,2 %
SimpleQA Verified 72,2 %
MATH Level 5 — non mesuré
Sur la ligne de Pareto : aucun modèle n'est à la fois meilleur et moins cher.
Claude Sonnet 5.5 🇺🇸 Anthropic · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 165,2 3e sur 37 en score · intervalle de confiance 161,8–169,4
Prix par million de tokens · mixte 3,56 € 12e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 95,6 %
SWE-bench Verified — non mesuré
FrontierMath 88,8 %
SimpleQA Verified 46,5 %
MATH Level 5 — non mesuré
Sur la ligne de Pareto : aucun modèle n'est à la fois meilleur et moins cher.
Claude Haiku 4.5 🇺🇸 Anthropic · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 142,4 30e sur 37 en score · intervalle de confiance 139,5–144,3
Prix par million de tokens · mixte 1,78 € 7e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 71,2 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified 13,2 %
MATH Level 5 96,4 %
Hors ligne de Pareto : battu en score et en prix par 6.
GPT-5.6 Sol 🇺🇸 OpenAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 161,8 5e sur 37 en score · intervalle de confiance 159,3–165,3
Prix par million de tokens · mixte 7,13 € 13e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 93,5 %
SWE-bench Verified — non mesuré
FrontierMath 89,1 %
SimpleQA Verified 69,7 %
MATH Level 5 — non mesuré
tarif promotionnel, au moins jusqu'au 21/11/2026
Hors ligne de Pareto : battu en score et en prix par 1.
GPT-5.6 Terra 🇺🇸 OpenAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 159,8 6e sur 37 en score · intervalle de confiance 157,1–162,8
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 93,3 %
SWE-bench Verified — non mesuré
FrontierMath 86,0 %
SimpleQA Verified 43,2 %
MATH Level 5 — non mesuré
GPT-5.6 Luna 🇺🇸 OpenAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 156,4 13e sur 37 en score · intervalle de confiance 154,1–158,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 91,6 %
SWE-bench Verified — non mesuré
FrontierMath 82,1 %
SimpleQA Verified 41,0 %
MATH Level 5 — non mesuré
Gemini 3.8 Flash 🇺🇸 Google · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 156,9 9e sur 37 en score · intervalle de confiance 154,6–160,4
Prix par million de tokens · mixte 1,34 € 4e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 95,4 %
SWE-bench Verified — non mesuré
FrontierMath 68,4 %
SimpleQA Verified 69,7 %
MATH Level 5 — non mesuré
jusqu'au 31/12/2026, puis 1,50 $ / 7,50 $
Hors ligne de Pareto : battu en score et en prix par 0.
Muse Spark 1.3 🇺🇸 Meta · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 156,9 9e sur 37 en score · intervalle de confiance 154,7–159,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond — non mesuré
SWE-bench Verified — non mesuré
FrontierMath 74,4 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Grok 4.5 🇺🇸 xAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 154,0 17e sur 37 en score · intervalle de confiance 152,3–156,1
Prix par million de tokens · mixte 2,67 € 10e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 93,4 %
SWE-bench Verified — non mesuré
FrontierMath 57,2 %
SimpleQA Verified 48,3 %
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 5.
Qwen3.8 Max 🇨🇳 Alibaba · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 156,6 11e sur 37 en score · intervalle de confiance 154,5–158,8
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 92,7 %
SWE-bench Verified — non mesuré
FrontierMath 74,7 %
SimpleQA Verified 45,8 %
MATH Level 5 — non mesuré
GLM-5.3 🇨🇳 Z.ai · Poids ouverts : oui · Licence : MIT
Voir tous les modèles Score 155,8 14e sur 37 en score · intervalle de confiance 153,7–158,3
Prix par million de tokens · mixte 1,92 € 8e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — non mesuré
FrontierMath 68,8 %
SimpleQA Verified 41,0 %
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 2.
Ressources pour le faire tourner chez vous →
GLM-5.3 Flash 🇨🇳 Z.ai · Poids ouverts : oui · Licence : MIT
Voir tous les modèles Score 151,9 18e sur 37 en score · intervalle de confiance 149,4–154,3
Prix par million de tokens · mixte 0,21 € 1e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 90,2 %
SWE-bench Verified — non mesuré
FrontierMath 55,8 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Sur la ligne de Pareto : aucun modèle n'est à la fois meilleur et moins cher.
Ressources pour le faire tourner chez vous →
DeepSeek V4.1 Flash 🇨🇳 DeepSeek · Poids ouverts : oui · Licence : MIT
Voir tous les modèles Score 155,0 16e sur 37 en score · intervalle de confiance 148,8–157,6
Prix par million de tokens · mixte 0,47 € 2e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond — non mesuré
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
tarif heures pleines, moitié prix en heures creuses
Sur la ligne de Pareto : aucun modèle n'est à la fois meilleur et moins cher.
Ressources pour le faire tourner chez vous →
DeepSeek V4 Pro 🇨🇳 DeepSeek · Poids ouverts : oui · Licence : MIT
Voir tous les modèles Score 155,4 15e sur 37 en score · intervalle de confiance 153,7–157,6
Prix par million de tokens · mixte 1,76 € 6e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 91,7 %
SWE-bench Verified — non mesuré
FrontierMath 64,6 %
SimpleQA Verified 52,9 %
MATH Level 5 — non mesuré
tarif heures pleines, moitié prix en heures creuses
Hors ligne de Pareto : battu en score et en prix par 2.
Ressources pour le faire tourner chez vous →
Qwen3.8 27B 🇨🇳 Alibaba · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 149,4 21e sur 37 en score · intervalle de confiance 147,4–151,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond — non mesuré
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Qwen3.5 397B 🇨🇳 Alibaba · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 146,7 24e sur 37 en score · intervalle de confiance 144,8–148,2
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 86,4 %
SWE-bench Verified — non mesuré
FrontierMath 31,2 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
MiniMax M3 🇨🇳 MiniMax · Poids ouverts : oui · Licence : MiniMax Community License
Voir tous les modèles Score 147,0 23e sur 37 en score · intervalle de confiance 142,7–149,8
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 90,9 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Gemma 4 31B 🇺🇸 Google · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 142,8 29e sur 37 en score · intervalle de confiance 140,3–144,9
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified 10,4 %
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Mistral Medium 3.5 🇫🇷 Mistral AI · Poids ouverts : oui · Licence : Modified MIT
Voir tous les modèles Score 141,4 32e sur 37 en score · intervalle de confiance 138,4–143,7
Prix par million de tokens · mixte 2,67 € 9e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond — non mesuré
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 8.
Ressources pour le faire tourner chez vous →
Mistral Small 3.2 🇫🇷 Mistral AI · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 131,7 37e sur 37 en score · intervalle de confiance 126,6–133,9
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 49,1 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
gpt-oss-120b 🇺🇸 OpenAI · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 139,9 33e sur 37 en score · intervalle de confiance 135,3–142,3
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 75,8 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
gpt-oss-20b 🇺🇸 OpenAI · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 137,8 35e sur 37 en score · intervalle de confiance 133,0–139,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 60,8 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Llama 4 Maverick 🇺🇸 Meta · Poids ouverts : oui · Licence : Llama 4
Voir tous les modèles Score 132,2 36e sur 37 en score · intervalle de confiance 128,0–134,1
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 67,0 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 73,0 %
Ressources pour le faire tourner chez vous →
GPT-6 Astra 🇺🇸 OpenAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 166,5 2e sur 37 en score · intervalle de confiance 163,1–171,1
Prix par million de tokens · mixte 17,82 € 15e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 95,8 %
SWE-bench Verified — non mesuré
FrontierMath 93,7 %
SimpleQA Verified 75,6 %
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 1.
Claude Fable 5.1 🇺🇸 Anthropic · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 164,8 4e sur 37 en score · intervalle de confiance 161,8–169,1
Prix par million de tokens · mixte 17,82 € 15e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond — non mesuré
SWE-bench Verified — non mesuré
FrontierMath 90,2 %
SimpleQA Verified 70,8 %
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 2.
Gemini 3.7 Flash 🇺🇸 Google · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 157,4 8e sur 37 en score · intervalle de confiance 155,4–160,1
Prix par million de tokens · mixte 1,34 € 4e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 94,8 %
SWE-bench Verified — non mesuré
FrontierMath 71,6 %
SimpleQA Verified 69,2 %
MATH Level 5 — non mesuré
jusqu'au 31/12/2026, puis 1,50 $ / 7,50 $
Sur la ligne de Pareto : aucun modèle n'est à la fois meilleur et moins cher.
Gemini 3.5 Flash-Lite 🇺🇸 Google · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 145,1 26e sur 37 en score · intervalle de confiance 142,5–146,7
Prix par million de tokens · mixte 0,76 € 3e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 83,3 %
SWE-bench Verified — non mesuré
FrontierMath 26,0 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 2.
Grok 4.6 🇺🇸 xAI · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 156,6 11e sur 37 en score · intervalle de confiance 154,7–158,9
Prix par million de tokens · mixte 2,67 € 10e sur 16 en prix
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 94,0 %
SWE-bench Verified — non mesuré
FrontierMath 66,0 %
SimpleQA Verified 49,3 %
MATH Level 5 — non mesuré
Hors ligne de Pareto : battu en score et en prix par 2.
Qwen3.7 Flash 🇨🇳 Alibaba · Poids ouverts : non · Licence : Propriétaire
Voir tous les modèles Score 144,6 27e sur 37 en score · intervalle de confiance 142,4–147,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 82,3 %
SWE-bench Verified — non mesuré
FrontierMath 19,3 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Kimi K3 🇨🇳 Moonshot AI · Poids ouverts : oui · Licence : Kimi K3 license
Voir tous les modèles Score 157,6 7e sur 37 en score · intervalle de confiance 154,9–160,4
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 93,1 %
SWE-bench Verified — non mesuré
FrontierMath 72,2 %
SimpleQA Verified 50,6 %
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Kimi K2.7 Code 🇨🇳 Moonshot AI · Poids ouverts : oui · Licence : —
Voir tous les modèles Score 150,0 20e sur 37 en score · intervalle de confiance 148,1–151,8
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 87,9 %
SWE-bench Verified — non mesuré
FrontierMath 54,0 %
SimpleQA Verified 36,5 %
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Inkling 🇺🇸 Thinking Machines · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 148,6 22e sur 37 en score · intervalle de confiance 145,7–150,6
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 88,3 %
SWE-bench Verified — non mesuré
FrontierMath 33,3 %
SimpleQA Verified 40,3 %
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Inkling Small 🇺🇸 Thinking Machines · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 150,2 19e sur 37 en score · intervalle de confiance 147,5–152,1
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 88,5 %
SWE-bench Verified — non mesuré
FrontierMath 46,3 %
SimpleQA Verified 19,1 %
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Nemotron 3 Ultra 🇺🇸 Nvidia · Poids ouverts : oui · Licence : OpenMDW-1.1
Voir tous les modèles Score 146,2 25e sur 37 en score · intervalle de confiance 143,9–148,1
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 85,4 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Qwen3.6 35B-A3B 🇨🇳 Alibaba · Poids ouverts : oui · Licence : —
Voir tous les modèles Score 143,9 28e sur 37 en score · intervalle de confiance 141,2–146,0
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 84,8 %
SWE-bench Verified — non mesuré
FrontierMath 20,4 %
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Gemma 4 26B A4B 🇺🇸 Google · Poids ouverts : oui · Licence : Apache 2.0
Voir tous les modèles Score 141,8 31e sur 37 en score · intervalle de confiance 138,4–143,4
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 73,2 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Qwen3.5 9B 🇨🇳 Alibaba · Poids ouverts : oui · Licence : —
Voir tous les modèles Score 139,5 34e sur 37 en score · intervalle de confiance 136,4–141,3
Prix par million de tokens — Prix officiel non publié par l'éditeur : ce modèle n'apparaît pas sur le graphique.
Benchmarks (meilleur résultat mesuré par Epoch) GPQA Diamond 79,0 %
SWE-bench Verified — non mesuré
FrontierMath — non mesuré
SimpleQA Verified — non mesuré
MATH Level 5 — non mesuré
Ressources pour le faire tourner chez vous →
Modèle Éditeur Poids ouverts Licence Score Prix entrée / sortie Prix mixte GPQA Diamond Claude Opus 5.5 Pareto 🇺🇸 Anthropic non Propriétaire 167,3 3,56 € / 17,82 € 7,13 € 90,6 % GPT-6 Astra 🇺🇸 OpenAI non Propriétaire 166,5 8,91 € / 44,54 € 17,82 € 95,8 % Claude Sonnet 5.5 Pareto 🇺🇸 Anthropic non Propriétaire 165,2 1,78 € / 8,91 € 3,56 € 95,6 % Claude Fable 5.1 🇺🇸 Anthropic non Propriétaire 164,8 8,91 € / 44,54 € 17,82 € — GPT-5.6 Sol 🇺🇸 OpenAI non Propriétaire 161,8 3,56 € / 17,82 € 7,13 € 93,5 % GPT-5.6 Terra 🇺🇸 OpenAI non Propriétaire 159,8 non publié — 93,3 % Kimi K3 🇨🇳 Moonshot AI oui Kimi K3 license 157,6 non publié — 93,1 % Gemini 3.7 Flash Pareto 🇺🇸 Google non Propriétaire 157,4 0,67 € / 3,34 € 1,34 € 94,8 % Gemini 3.8 Flash 🇺🇸 Google non Propriétaire 156,9 0,67 € / 3,34 € 1,34 € 95,4 % Muse Spark 1.3 🇺🇸 Meta non Propriétaire 156,9 non publié — — Qwen3.8 Max 🇨🇳 Alibaba non Propriétaire 156,6 non publié — 92,7 % Grok 4.6 🇺🇸 xAI non Propriétaire 156,6 1,78 € / 5,35 € 2,67 € 94,0 % GPT-5.6 Luna 🇺🇸 OpenAI non Propriétaire 156,4 non publié — 91,6 % GLM-5.3 🇨🇳 Z.ai oui MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 % DeepSeek V4 Pro 🇨🇳 DeepSeek oui MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 % DeepSeek V4.1 Flash Pareto 🇨🇳 DeepSeek oui MIT 155,0 0,27 € / 1,07 € 0,47 € — Grok 4.5 🇺🇸 xAI non Propriétaire 154,0 1,78 € / 5,35 € 2,67 € 93,4 % GLM-5.3 Flash Pareto 🇨🇳 Z.ai oui MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 % Inkling Small 🇺🇸 Thinking Machines oui Apache 2.0 150,2 non publié — 88,5 % Kimi K2.7 Code 🇨🇳 Moonshot AI oui — 150,0 non publié — 87,9 % Qwen3.8 27B 🇨🇳 Alibaba oui Apache 2.0 149,4 non publié — — Inkling 🇺🇸 Thinking Machines oui Apache 2.0 148,6 non publié — 88,3 % MiniMax M3 🇨🇳 MiniMax oui MiniMax Community License 147,0 non publié — 90,9 % Qwen3.5 397B 🇨🇳 Alibaba oui Apache 2.0 146,7 non publié — 86,4 % Nemotron 3 Ultra 🇺🇸 Nvidia oui OpenMDW-1.1 146,2 non publié — 85,4 % Gemini 3.5 Flash-Lite 🇺🇸 Google non Propriétaire 145,1 0,27 € / 2,23 € 0,76 € 83,3 % Qwen3.7 Flash 🇨🇳 Alibaba non Propriétaire 144,6 non publié — 82,3 % Qwen3.6 35B-A3B 🇨🇳 Alibaba oui — 143,9 non publié — 84,8 % Gemma 4 31B 🇺🇸 Google oui Apache 2.0 142,8 non publié — 75,8 % Claude Haiku 4.5 🇺🇸 Anthropic non Propriétaire 142,4 0,89 € / 4,45 € 1,78 € 71,2 % Gemma 4 26B A4B 🇺🇸 Google oui Apache 2.0 141,8 non publié — 73,2 % Mistral Medium 3.5 🇫🇷 Mistral AI oui Modified MIT 141,4 1,34 € / 6,68 € 2,67 € — gpt-oss-120b 🇺🇸 OpenAI oui Apache 2.0 139,9 non publié — 75,8 % Qwen3.5 9B 🇨🇳 Alibaba oui — 139,5 non publié — 79,0 % gpt-oss-20b 🇺🇸 OpenAI oui Apache 2.0 137,8 non publié — 60,8 % Llama 4 Maverick 🇺🇸 Meta oui Llama 4 132,2 non publié — 67,0 % Mistral Small 3.2 🇫🇷 Mistral AI oui Apache 2.0 131,7 non publié — 49,1 %
Questions fréquentes Que veut dire « poids ouverts » ? Les poids sont les milliards de nombres qui contiennent ce qu'un modèle a appris. Un modèle à poids ouverts peut être téléchargé et exécuté sur votre propre machine ; un modèle fermé n'est accessible que par l'API de son éditeur. Poids ouverts ne veut pas dire open source : la licence peut limiter l'usage.
Comment est mesurée l'intelligence des modèles ? Par l'indice de capacités d'Epoch AI (ECI), qui combine les résultats de nombreux benchmarks : raisonnement scientifique (GPQA Diamond), code (SWE-bench Verified), mathématiques (FrontierMath), exactitude des faits (SimpleQA Verified).
D'où viennent les prix ? Des pages de tarifs officielles des éditeurs, en dollars par million de tokens, convertis en euros au taux de référence de la Banque centrale européenne. Le prix mixte compte 3/4 du prix d'entrée et 1/4 du prix de sortie.
Qu'est-ce que la ligne de Pareto ? Elle relie les modèles qu'aucun autre ne bat à la fois en intelligence et en prix : ce sont les meilleurs compromis du moment.
Cette information vous a-t-elle été utile ?