Quale modello di IA per un RAG sui tuoi documenti?
Un assistente che risponde a partire dai tuoi documenti (RAG): documentazione di prodotto, procedure, base di conoscenza.
DeepSeek V4.1 Flash
0,27 € / 1,07 € per milione di token (input / output)
Sulla linea di Pareto, indice di capacità di 155 a un prezzo basso: adatto ai lunghi passaggi letti a ogni domanda.
Costo per 1 milione di domande di circa 4000 token letti (domanda e passaggi) e 400 scritti: 1496 €.
Vedi nella classifica →Qwen3.8 27B
Gratuito nell'uso: solo il costo della tua macchina (basta una scheda grafica da 24 GB con quantizzazione Q4, embedding inclusi).
Pesi aperti con licenza Apache 2.0: con un modello di embedding locale, né i documenti né le domande lasciano il tuo server.
Vedi nella classifica →Claude Sonnet 5.5
1,78 € / 8,91 € per milione di token (input / output)
Sulla linea di Pareto, con uno dei migliori indici di capacità: più capace di dire «non lo so» quando i passaggi non contengono la risposta.
Costo per 1 milione di domande di circa 4000 token letti (domanda e passaggi) e 400 scritti: 10.692 €.
Vedi nella classifica →Perché queste scelte
In un RAG la qualità dipende prima dalla ricerca dei passaggi (il modello di embedding e la suddivisione dei documenti), poi dal modello che scrive la risposta. Ogni domanda fa leggere diverse migliaia di token: il prezzo di input pesa più di quello di output.
Passa all'azione
Dati: indice Epoch AI (CC BY 4.0), prezzi ufficiali degli sviluppatori convertiti al tasso BCE, aggiornati il 2026-10-03 · Classifica dei modelli di IA: intelligenza, benchmark e prezzo