Quel modèle d'IA pour extraire des données de documents ?
Factures, CV, tickets, formulaires : transformer un texte en données structurées (JSON).
GLM-5.3 Flash
0,13 € / 0,45 € par million de tokens (entrée / sortie)
Le moins cher des modèles de la ligne de Pareto : aucun modèle n'est à la fois plus capable et moins cher.
Coût pour 1 million de documents d'environ 1 500 tokens lus et 300 écrits : 335 €.
Voir dans le classement →Qwen3.8 27B
Gratuit à l'usage : coût de votre machine (une carte graphique de 24 Go suffit en quantification Q4).
Poids ouverts sous licence Apache 2.0, 27 milliards de paramètres : il tourne sur un seul serveur avec une carte graphique de 24 Go, et rien ne sort de chez vous.
Voir dans le classement →Claude Sonnet 5.5
1,78 € / 8,91 € par million de tokens (entrée / sortie)
Sur la ligne de Pareto, avec l'un des meilleurs indices de capacités : moins d'erreurs à corriger sur les documents complexes ou mal scannés.
Coût pour 1 million de documents d'environ 1 500 tokens lus et 300 écrits : 5 346 €.
Voir dans le classement →Pourquoi ces choix
Pour l'extraction, ce qui compte : suivre un format JSON, ne rien inventer, et le prix par document quand le volume est grand. Aucun benchmark de l'index ne mesure directement l'extraction : l'indice de capacités sert de repère général, et le prix fait la différence à grande échelle.
Passer à l'action
Données : indice Epoch AI (CC BY 4.0), prix officiels des éditeurs convertis au taux BCE, mis à jour le 2026-10-03 · Classement des modèles IA : intelligence, benchmarks et prix