DE
Anmelden Veröffentlichen
contextetech /

llama.cpp server for a GGUF model

v1
Englisch Lizenz: MIT Veröffentlicht am aktualisiert vor 1 Stunde 0 Nutzungen

Run any GGUF model with the llama.cpp server: OpenAI-compatible API on port 8080, works without a GPU too.

Modellmodel.gguf
Getestete HardwareCPU only, or a GPU (use -ngl to offload layers)

Startbefehl

llama-server -m model.gguf -c 8192 --host 127.0.0.1 --port 8080

Community

Noch keine Kommentare. Teile deine Erfahrung, sie hilft den Nächsten.