Zaloguj się Opublikuj

Ranking modeli AI: inteligencja, benchmarki i cena

Każdy punkt to model: im wyżej, tym lepiej wypada; im bardziej na lewo, tym jest tańszy. Kliknij model, aby zobaczyć go osobno.

Najbardziej atrakcyjny obszar 140150160170 0,10 €0,30 €1,00 €3,00 €10,00 €30,00 € Cena za milion tokenów (€, 3/4 wejście + 1/4 wyjście, skala logarytmiczna) Epoch Capabilities Index (ECI) Claude Opus 5.5 (Anthropic) · Wynik 167,3 · 3,56 € / 17,82 € Claude Opus 5.5 Claude Sonnet 5.5 (Anthropic) · Wynik 165,2 · 1,78 € / 8,91 € Claude Sonnet 5.5 Claude Haiku 4.5 (Anthropic) · Wynik 142,4 · 0,89 € / 4,45 € Claude Haiku 4.5 GPT-5.6 Sol (OpenAI) · Wynik 161,8 · 3,56 € / 17,82 € GPT-5.6 Sol Gemini 3.8 Flash (Google) · Wynik 156,9 · 0,67 € / 3,34 € Gemini 3.8 Flash Grok 4.5 (xAI) · Wynik 154,0 · 1,78 € / 5,35 € Grok 4.5 GLM-5.3 (Z.ai) · Wynik 155,8 · 1,25 € / 3,92 € GLM-5.3 GLM-5.3 Flash (Z.ai) · Wynik 151,9 · 0,13 € / 0,45 € GLM-5.3 Flash DeepSeek V4.1 Flash (DeepSeek) · Wynik 155,0 · 0,27 € / 1,07 € DeepSeek V4.1 Flash DeepSeek V4 Pro (DeepSeek) · Wynik 155,4 · 1,18 € / 3,53 € DeepSeek V4 Pro Mistral Medium 3.5 (Mistral AI) · Wynik 141,4 · 1,34 € / 6,68 € Mistral Medium 3.5 GPT-6 Astra (OpenAI) · Wynik 166,5 · 8,91 € / 44,54 € GPT-6 Astra Claude Fable 5.1 (Anthropic) · Wynik 164,8 · 8,91 € / 44,54 € Claude Fable 5.1 Gemini 3.7 Flash (Google) · Wynik 157,4 · 0,67 € / 3,34 € Gemini 3.7 Flash Gemini 3.5 Flash-Lite (Google) · Wynik 145,1 · 0,27 € / 2,23 € Gemini 3.5 Flash-Lite Grok 4.6 (xAI) · Wynik 156,6 · 1,78 € / 5,35 € Grok 4.6
Otwarte wagi Tylko API Linia Pareto
ModelProducentOtwarte wagiLicencjaWynikCena wejścia / wyjściaCena łączonaGPQA Diamond
Claude Opus 5.5Pareto 🇺🇸 Anthropic nie Własnościowa 167,3 3,56 € / 17,82 € 7,13 € 90,6 %
GPT-6 Astra 🇺🇸 OpenAI nie Własnościowa 166,5 8,91 € / 44,54 € 17,82 € 95,8 %
Claude Sonnet 5.5Pareto 🇺🇸 Anthropic nie Własnościowa 165,2 1,78 € / 8,91 € 3,56 € 95,6 %
Claude Fable 5.1 🇺🇸 Anthropic nie Własnościowa 164,8 8,91 € / 44,54 € 17,82 € —
GPT-5.6 Sol 🇺🇸 OpenAI nie Własnościowa 161,8 3,56 € / 17,82 € 7,13 € 93,5 %
GPT-5.6 Terra 🇺🇸 OpenAI nie Własnościowa 159,8 nieopublikowana — 93,3 %
Kimi K3 🇨🇳 Moonshot AI tak Kimi K3 license 157,6 nieopublikowana — 93,1 %
Gemini 3.7 FlashPareto 🇺🇸 Google nie Własnościowa 157,4 0,67 € / 3,34 € 1,34 € 94,8 %
Gemini 3.8 Flash 🇺🇸 Google nie Własnościowa 156,9 0,67 € / 3,34 € 1,34 € 95,4 %
Muse Spark 1.3 🇺🇸 Meta nie Własnościowa 156,9 nieopublikowana — —
Qwen3.8 Max 🇨🇳 Alibaba nie Własnościowa 156,6 nieopublikowana — 92,7 %
Grok 4.6 🇺🇸 xAI nie Własnościowa 156,6 1,78 € / 5,35 € 2,67 € 94,0 %
GPT-5.6 Luna 🇺🇸 OpenAI nie Własnościowa 156,4 nieopublikowana — 91,6 %
GLM-5.3 🇨🇳 Z.ai tak MIT 155,8 1,25 € / 3,92 € 1,92 € 90,9 %
DeepSeek V4 Pro 🇨🇳 DeepSeek tak MIT 155,4 1,18 € / 3,53 € 1,76 € 91,7 %
DeepSeek V4.1 FlashPareto 🇨🇳 DeepSeek tak MIT 155,0 0,27 € / 1,07 € 0,47 € —
Grok 4.5 🇺🇸 xAI nie Własnościowa 154,0 1,78 € / 5,35 € 2,67 € 93,4 %
GLM-5.3 FlashPareto 🇨🇳 Z.ai tak MIT 151,9 0,13 € / 0,45 € 0,21 € 90,2 %
Inkling Small 🇺🇸 Thinking Machines tak Apache 2.0 150,2 nieopublikowana — 88,5 %
Kimi K2.7 Code 🇨🇳 Moonshot AI tak — 150,0 nieopublikowana — 87,9 %
Qwen3.8 27B 🇨🇳 Alibaba tak Apache 2.0 149,4 nieopublikowana — —
Inkling 🇺🇸 Thinking Machines tak Apache 2.0 148,6 nieopublikowana — 88,3 %
MiniMax M3 🇨🇳 MiniMax tak MiniMax Community License 147,0 nieopublikowana — 90,9 %
Qwen3.5 397B 🇨🇳 Alibaba tak Apache 2.0 146,7 nieopublikowana — 86,4 %
Nemotron 3 Ultra 🇺🇸 Nvidia tak OpenMDW-1.1 146,2 nieopublikowana — 85,4 %
Gemini 3.5 Flash-Lite 🇺🇸 Google nie Własnościowa 145,1 0,27 € / 2,23 € 0,76 € 83,3 %
Qwen3.7 Flash 🇨🇳 Alibaba nie Własnościowa 144,6 nieopublikowana — 82,3 %
Qwen3.6 35B-A3B 🇨🇳 Alibaba tak — 143,9 nieopublikowana — 84,8 %
Gemma 4 31B 🇺🇸 Google tak Apache 2.0 142,8 nieopublikowana — 75,8 %
Claude Haiku 4.5 🇺🇸 Anthropic nie Własnościowa 142,4 0,89 € / 4,45 € 1,78 € 71,2 %
Gemma 4 26B A4B 🇺🇸 Google tak Apache 2.0 141,8 nieopublikowana — 73,2 %
Mistral Medium 3.5 🇫🇷 Mistral AI tak Modified MIT 141,4 1,34 € / 6,68 € 2,67 € —
gpt-oss-120b 🇺🇸 OpenAI tak Apache 2.0 139,9 nieopublikowana — 75,8 %
Qwen3.5 9B 🇨🇳 Alibaba tak — 139,5 nieopublikowana — 79,0 %
gpt-oss-20b 🇺🇸 OpenAI tak Apache 2.0 137,8 nieopublikowana — 60,8 %
Llama 4 Maverick 🇺🇸 Meta tak Llama 4 132,2 nieopublikowana — 67,0 %
Mistral Small 3.2 🇫🇷 Mistral AI tak Apache 2.0 131,7 nieopublikowana — 49,1 %

Metoda

Wynik: indeks możliwości Epoch AI, podsumowujący wiele benchmarków przeprowadzonych przez Epoch (GPQA, SWE-bench, FrontierMath…). Cena: oficjalne stawki producentów przeliczone na euro po kursie EBC; cena łączona liczy wejście w 3/4, a wyjście w 1/4. Modele bez oficjalnej ceny są w tabeli, ale nie na wykresie.

Źródła: Wyniki: Epoch AI, Capabilities & benchmarking (CC BY 4.0), do 2026-09-28 · Ceny: strony producentów, sprawdzone 2026-10-03 · Licencje: zbiór danych Arena (CC BY 4.0) · Kurs EBC z 2026-10-02: 1 € = 1,1225 $

FAQ

Co oznaczają „otwarte wagi”?

Wagi to miliardy liczb, w których zapisane jest to, czego model się nauczył. Model z otwartymi wagami można pobrać i uruchomić na własnej maszynie; model zamknięty jest dostępny tylko przez API producenta. Otwarte wagi nie oznaczają open source: licencja może ograniczać użycie.

Jak mierzy się inteligencję modeli?

Za pomocą indeksu możliwości Epoch AI (ECI), który łączy wyniki wielu benchmarków: rozumowanie naukowe (GPQA Diamond), programowanie (SWE-bench Verified), matematyka (FrontierMath), dokładność faktograficzna (SimpleQA Verified).

Skąd pochodzą ceny?

Z oficjalnych stron z cennikami producentów, w dolarach za milion tokenów, przeliczonych na euro po kursie referencyjnym Europejskiego Banku Centralnego. Cena łączona uwzględnia 3/4 ceny wejścia i 1/4 ceny wyjścia.

Czym jest linia Pareto?

Łączy modele, których żaden inny model nie przewyższa jednocześnie pod względem inteligencji i ceny: obecnie najlepsze kompromisy.

Czy ta informacja była przydatna?