FR
Connexion Publier

Configs d'inférence pour LLM en local

Des réglages prêts à lancer pour faire tourner un modèle chez vous : Modelfile Ollama, commande vLLM, llama.cpp.

3 résultat(s)

Qu'est-ce qu'une config d'inférence ?

Une config d'inférence est l'ensemble des réglages qui permettent de faire tourner un modèle sur sa propre machine : le moteur (Ollama, vLLM, llama.cpp), la quantification, la taille du contexte et la commande de lancement.

Guide : Configs d'inférence →