Modèles & Runtime
Lancez des modèles locaux sans abandonner le contrôle.
Téléchargez des modèles GGUF, enregistrez des profils, lancez llama.cpp, consultez logs et métriques ou connectez-vous directement au serveur lorsque vous avez besoin d’un contrôle complet.
Explorer ce domaine →- bibliothèque GGUF locale et téléchargements Hugging Face
- profils, variantes, groupes et paramètres runtime
- démarrage/arrêt de llama.cpp et accès direct au serveur
- serving /v1 local plus providers self-hosted et connectés