ES
Iniciar sesión Publicar
contextetech /

llama.cpp server for a GGUF model

v1
Inglés Licencia: MIT Publicado el actualizado hace 1 hora 0 usos

Run any GGUF model with the llama.cpp server: OpenAI-compatible API on port 8080, works without a GPU too.

Modelomodel.gguf
Hardware probadoCPU only, or a GPU (use -ngl to offload layers)

Comando de lanzamiento

llama-server -m model.gguf -c 8192 --host 127.0.0.1 --port 8080

Comunidad

Aún no hay comentarios. Comparte tu opinión, ayudará a los siguientes.