DE
Anmelden Veröffentlichen

Inferenz-Konfigurationen für lokale LLMs

Startfertige Einstellungen, um ein Modell lokal auszuführen: Ollama-Modelfile, vLLM-Befehl, llama.cpp.

3 Ergebnis(se)

Was ist eine Inferenz-Konfiguration?

Eine Inferenz-Konfiguration bündelt die Einstellungen, um ein Modell auf dem eigenen Rechner zu betreiben: Laufzeit (Ollama, vLLM, llama.cpp), Quantisierung, Kontextgröße und Startbefehl.

Anleitung: Inferenz-Konfigurationen →