Choisir son serveur GPU pour l'intelligence artificielle locale
Votre modèle, votre volume : la mémoire nécessaire et le matériel qui suffit pour faire tourner une IA chez vous.
- Taille
- actifs
- Indice de capacités
Votre usage
| Matériel | Mémoire | Unités | Débit maximal théorique |
|---|
Calcul : poids du modèle (paramètres × octets par paramètre) + 20 % pour le contexte et l'exécution. Débit : débit mémoire ÷ poids lus par token ; c'est un maximum, comptez en pratique 50 à 70 %.
Sources : NVIDIA · Apple · fiches officielles des éditeurs des modèles (taille)
Cette information vous a-t-elle été utile ?