FR
Connexion Publier

Quel modèle d'IA pour extraire des données de documents ?

Factures, CV, tickets, formulaires : transformer un texte en données structurées (JSON).

Vos contraintes
Gros volume

GLM-5.3 Flash

Z.ai · Licence : MIT · Indice de capacités 151,9

0,13 € / 0,45 € par million de tokens (entrée / sortie)

Le moins cher des modèles de la ligne de Pareto : aucun modèle n'est à la fois plus capable et moins cher.

Coût pour 1 million de documents d'environ 1 500 tokens lus et 300 écrits : 335 €.

Voir dans le classement →
Données sensibles

Qwen3.8 27B

Alibaba · Licence : Apache 2.0 · Indice de capacités 149,4

Gratuit à l'usage : coût de votre machine (une carte graphique de 24 Go suffit en quantification Q4).

Poids ouverts sous licence Apache 2.0, 27 milliards de paramètres : il tourne sur un seul serveur avec une carte graphique de 24 Go, et rien ne sort de chez vous.

Voir dans le classement →
Précision maximale

Claude Sonnet 5.5

Anthropic · Licence : Propriétaire · Indice de capacités 165,2

1,78 € / 8,91 € par million de tokens (entrée / sortie)

Sur la ligne de Pareto, avec l'un des meilleurs indices de capacités : moins d'erreurs à corriger sur les documents complexes ou mal scannés.

Coût pour 1 million de documents d'environ 1 500 tokens lus et 300 écrits : 5 346 €.

Voir dans le classement →

Pourquoi ces choix

Pour l'extraction, ce qui compte : suivre un format JSON, ne rien inventer, et le prix par document quand le volume est grand. Aucun benchmark de l'index ne mesure directement l'extraction : l'indice de capacités sert de repère général, et le prix fait la différence à grande échelle.

Passer à l'action

Données : indice Epoch AI (CC BY 4.0), prix officiels des éditeurs convertis au taux BCE, mis à jour le 2026-10-03 · Classement des modèles IA : intelligence, benchmarks et prix

Cette information vous a-t-elle été utile ?