Modele i Runtime
Uruchamiaj lokalne modele bez rezygnowania z kontroli.
Pobieraj modele GGUF, zapisuj profile, uruchamiaj llama.cpp, obserwuj logi i metryki albo łącz się bezpośrednio z serwerem, gdy potrzebujesz pełnej kontroli.
Poznaj ten obszar →- lokalna biblioteka GGUF i pobieranie z Hugging Face
- profile, warianty, grupy i ustawienia runtime'u
- start/stop llama.cpp oraz bezpośredni dostęp do serwera
- lokalne /v1 oraz providerzy self-hosted i połączeni