IT
Accedi Pubblica

Quale modello di IA per un RAG sui tuoi documenti?

Un assistente che risponde a partire dai tuoi documenti (RAG): documentazione di prodotto, procedure, base di conoscenza.

I tuoi vincoli
Molte domande

DeepSeek V4.1 Flash

DeepSeek · Licenza: MIT · Indice di capacità 155,0

0,27 € / 1,07 € per milione di token (input / output)

Sulla linea di Pareto, indice di capacità di 155 a un prezzo basso: adatto ai lunghi passaggi letti a ogni domanda.

Costo per 1 milione di domande di circa 4000 token letti (domanda e passaggi) e 400 scritti: 1496 €.

Vedi nella classifica →
Documenti riservati

Qwen3.8 27B

Alibaba · Licenza: Apache 2.0 · Indice di capacità 149,4

Gratuito nell'uso: solo il costo della tua macchina (basta una scheda grafica da 24 GB con quantizzazione Q4, embedding inclusi).

Pesi aperti con licenza Apache 2.0: con un modello di embedding locale, né i documenti né le domande lasciano il tuo server.

Vedi nella classifica →
Massima affidabilità

Claude Sonnet 5.5

Anthropic · Licenza: Proprietaria · Indice di capacità 165,2

1,78 € / 8,91 € per milione di token (input / output)

Sulla linea di Pareto, con uno dei migliori indici di capacità: più capace di dire «non lo so» quando i passaggi non contengono la risposta.

Costo per 1 milione di domande di circa 4000 token letti (domanda e passaggi) e 400 scritti: 10.692 €.

Vedi nella classifica →

Perché queste scelte

In un RAG la qualità dipende prima dalla ricerca dei passaggi (il modello di embedding e la suddivisione dei documenti), poi dal modello che scrive la risposta. Ogni domanda fa leggere diverse migliaia di token: il prezzo di input pesa più di quello di output.

Passa all'azione

Dati: indice Epoch AI (CC BY 4.0), prezzi ufficiali degli sviluppatori convertiti al tasso BCE, aggiornati il 2026-10-03 · Classifica dei modelli di IA: intelligenza, benchmark e prezzo

Queste informazioni ti sono state utili?