DE
Anmelden Veröffentlichen
contextetech /

Serveur llama.cpp pour un modèle GGUF

v1
Französisch Lizenz: MIT Veröffentlicht am aktualisiert gestern 0 Nutzungen

Lancer n'importe quel modèle GGUF avec le serveur de llama.cpp : API compatible OpenAI sur le port 8080, fonctionne aussi sans carte graphique.

Modellmodele.gguf
Getestete HardwareProcesseur seul ou carte graphique (option -ngl pour y charger des couches)

Startbefehl

llama-server -m modele.gguf -c 8192 --host 127.0.0.1 --port 8080

Community

Noch keine Kommentare. Teile deine Erfahrung, sie hilft den Nächsten.