IT
Accedi Pubblica

Classifica dei modelli di IA: intelligenza, benchmark e prezzo

Ogni punto è un modello: più è in alto, meglio è classificato; più è a sinistra, meno costa. Fai clic su un modello per vederlo da solo.

Zona più interessante 140150160170 0,10 €0,30 €1,00 €3,00 €10,00 €30,00 € Prezzo per milione di token (€, 3/4 input + 1/4 output, scala log) Indice di capacità di Epoch (ECI) Claude Opus 5.5 (Anthropic) · Punteggio 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Punteggio 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Punteggio 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Punteggio 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Punteggio 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Punteggio 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Punteggio 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Punteggio 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Punteggio 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Punteggio 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Punteggio 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Punteggio 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Punteggio 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Punteggio 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Punteggio 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Punteggio 156,6 · 1,78 € / 5,35 € Grok 4.6
Pesi aperti Solo API Linea di Pareto
ModelloSviluppatorePesi apertiLicenzaPunteggioPrezzo input / outputPrezzo mistoGPQA Diamond
Claude Opus 5.5Pareto 🇺🇸 Anthropic no Proprietaria 167,3 3,56 € / 17,82 € 7,13 € 90,6 %
GPT-6 Astra 🇺🇸 OpenAI no Proprietaria 166,5 8,91 € / 44,54 € 17,82 € 95,8 %
Claude Sonnet 5.5Pareto 🇺🇸 Anthropic no Proprietaria 165,2 1,78 € / 8,91 € 3,56 € 95,6 %
Claude Fable 5.1 🇺🇸 Anthropic no Proprietaria 164,8 8,91 € / 44,54 € 17,82 € —
GPT-5.6 Sol 🇺🇸 OpenAI no Proprietaria 161,8 3,56 € / 17,82 € 7,13 € 93,5 %
GPT-5.6 Terra 🇺🇸 OpenAI no Proprietaria 159,8 non pubblicato — 93,3 %
Kimi K3 🇨🇳 Moonshot AI sì Kimi K3 license 157,6 non pubblicato — 93,1 %
Gemini 3.7 FlashPareto 🇺🇸 Google no Proprietaria 157,4 0,67 € / 3,34 € 1,34 € 94,8 %
Gemini 3.8 Flash 🇺🇸 Google no Proprietaria 156,9 0,67 € / 3,34 € 1,34 € 95,4 %
Muse Spark 1.3 🇺🇸 Meta no Proprietaria 156,9 non pubblicato — —
Qwen3.8 Max 🇨🇳 Alibaba no Proprietaria 156,6 non pubblicato — 92,7 %
Grok 4.6 🇺🇸 xAI no Proprietaria 156,6 1,78 € / 5,35 € 2,67 € 94,0 %
GPT-5.6 Luna 🇺🇸 OpenAI no Proprietaria 156,4 non pubblicato — 91,6 %
GLM-5.3 🇨🇳 Z.ai sì MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 %
DeepSeek V4 Pro 🇨🇳 DeepSeek sì MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 %
DeepSeek V4.1 FlashPareto 🇨🇳 DeepSeek sì MIT 155,0 0,27 € / 1,07 € 0,47 € —
Grok 4.5 🇺🇸 xAI no Proprietaria 154,0 1,78 € / 5,35 € 2,67 € 93,4 %
GLM-5.3 FlashPareto 🇨🇳 Z.ai sì MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 %
Inkling Small 🇺🇸 Thinking Machines sì Apache 2.0 150,2 non pubblicato — 88,5 %
Kimi K2.7 Code 🇨🇳 Moonshot AI sì — 150,0 non pubblicato — 87,9 %
Qwen3.8 27B 🇨🇳 Alibaba sì Apache 2.0 149,4 non pubblicato — —
Inkling 🇺🇸 Thinking Machines sì Apache 2.0 148,6 non pubblicato — 88,3 %
MiniMax M3 🇨🇳 MiniMax sì MiniMax Community License 147,0 non pubblicato — 90,9 %
Qwen3.5 397B 🇨🇳 Alibaba sì Apache 2.0 146,7 non pubblicato — 86,4 %
Nemotron 3 Ultra 🇺🇸 Nvidia sì OpenMDW-1.1 146,2 non pubblicato — 85,4 %
Gemini 3.5 Flash-Lite 🇺🇸 Google no Proprietaria 145,1 0,27 € / 2,23 € 0,76 € 83,3 %
Qwen3.7 Flash 🇨🇳 Alibaba no Proprietaria 144,6 non pubblicato — 82,3 %
Qwen3.6 35B-A3B 🇨🇳 Alibaba sì — 143,9 non pubblicato — 84,8 %
Gemma 4 31B 🇺🇸 Google sì Apache 2.0 142,8 non pubblicato — 75,8 %
Claude Haiku 4.5 🇺🇸 Anthropic no Proprietaria 142,4 0,89 € / 4,45 € 1,78 € 71,2 %
Gemma 4 26B A4B 🇺🇸 Google sì Apache 2.0 141,8 non pubblicato — 73,2 %
Mistral Medium 3.5 🇫🇷 Mistral AI sì Modified MIT 141,4 1,34 € / 6,68 € 2,67 € —
gpt-oss-120b 🇺🇸 OpenAI sì Apache 2.0 139,9 non pubblicato — 75,8 %
Qwen3.5 9B 🇨🇳 Alibaba sì — 139,5 non pubblicato — 79,0 %
gpt-oss-20b 🇺🇸 OpenAI sì Apache 2.0 137,8 non pubblicato — 60,8 %
Llama 4 Maverick 🇺🇸 Meta sì Llama 4 132,2 non pubblicato — 67,0 %
Mistral Small 3.2 🇫🇷 Mistral AI sì Apache 2.0 131,7 non pubblicato — 49,1 %

Metodo

Punteggio: indice di capacità di Epoch AI, che riassume molti benchmark misurati da Epoch (GPQA, SWE-bench, FrontierMath…). Prezzo: tariffe ufficiali degli sviluppatori, convertite in euro al tasso BCE; il prezzo misto pesa 3/4 l'input e 1/4 l'output. Senza prezzo ufficiale, un modello è nella tabella ma non nel grafico.

Fonti: Punteggi: Epoch AI, Capabilities & benchmarking (CC BY 4.0), aggiornati al 2026-09-28 · Prezzi: pagine degli sviluppatori, verificati il 2026-10-03 · Licenze: dataset di Arena (CC BY 4.0) · tasso BCE del 2026-10-02: 1 € = 1,1225 $

Domande frequenti

Che cosa significa «pesi aperti»?

I pesi sono i miliardi di numeri che contengono ciò che un modello ha imparato. Un modello a pesi aperti si può scaricare ed eseguire sul proprio computer; un modello chiuso è accessibile solo tramite l'API del suo sviluppatore. Pesi aperti non vuol dire open source: la licenza può limitarne l'uso.

Come si misura l'intelligenza dei modelli?

Con l'indice di capacità di Epoch AI (ECI), che combina i risultati di molti benchmark: ragionamento scientifico (GPQA Diamond), codice (SWE-bench Verified), matematica (FrontierMath), accuratezza dei fatti (SimpleQA Verified).

Da dove vengono i prezzi?

Dalle pagine ufficiali dei prezzi degli sviluppatori, in dollari per milione di token, convertiti in euro al tasso di riferimento della Banca centrale europea. Il prezzo misto conta 3/4 del prezzo di input e 1/4 di quello di output.

Che cos'è la linea di Pareto?

Collega i modelli che nessun altro supera sia per intelligenza sia per prezzo: i migliori compromessi del momento.

Queste informazioni ti sono state utili?