FR
Connexion Publier
contextetech /

Serveur llama.cpp pour un modèle GGUF

v1
Français Licence : MIT Mis en ligne le mis à jour hier 0 utilisations

Lancer n'importe quel modèle GGUF avec le serveur de llama.cpp : API compatible OpenAI sur le port 8080, fonctionne aussi sans carte graphique.

Modèlemodele.gguf
Matériel testéProcesseur seul ou carte graphique (option -ngl pour y charger des couches)

Commande de lancement

llama-server -m modele.gguf -c 8192 --host 127.0.0.1 --port 8080

Communauté

Pas encore de commentaire. Partagez votre retour, il aidera les suivants.