Modelle & Runtime
Lokale Modelle ausführen, ohne Kontrolle aufzugeben.
GGUF-Modelle herunterladen, Profile speichern, llama.cpp starten, Logs und Metriken beobachten oder direkt zum Server verbinden, wenn du volle Kontrolle brauchst.
Diesen Bereich erkunden →- lokale GGUF-Bibliothek und Hugging-Face-Downloads
- Profile, Varianten, Gruppen und Runtime-Einstellungen
- llama.cpp starten/stoppen und direkter Serverzugriff
- lokales /v1 Serving plus self-hosted und verbundene Provider