ES
Iniciar sesión Publicar
contextetech /

Serveur llama.cpp pour un modèle GGUF

v1
Francés Licencia: MIT Publicado el actualizado ayer 0 usos

Lancer n'importe quel modèle GGUF avec le serveur de llama.cpp : API compatible OpenAI sur le port 8080, fonctionne aussi sans carte graphique.

Modelomodele.gguf
Hardware probadoProcesseur seul ou carte graphique (option -ngl pour y charger des couches)

Comando de lanzamiento

llama-server -m modele.gguf -c 8192 --host 127.0.0.1 --port 8080

Comunidad

Aún no hay comentarios. Comparte tu opinión, ayudará a los siguientes.