IT
Accedi Pubblica
contextetech /

Serveur llama.cpp pour un modèle GGUF

v1
Francese Licenza: MIT Pubblicato il aggiornato ieri 0 utilizzi

Lancer n'importe quel modèle GGUF avec le serveur de llama.cpp : API compatible OpenAI sur le port 8080, fonctionne aussi sans carte graphique.

Modellomodele.gguf
Hardware testatoProcesseur seul ou carte graphique (option -ngl pour y charger des couches)

Comando di avvio

llama-server -m modele.gguf -c 8192 --host 127.0.0.1 --port 8080

Community

Ancora nessun commento. Condividi la tua esperienza, aiuterà chi viene dopo.