Modelos y Runtime
Ejecuta modelos locales sin renunciar al control.
Descarga modelos GGUF, guarda perfiles, inicia llama.cpp, consulta logs y métricas o conéctate directamente al servidor cuando necesites control total.
Explorar este ámbito →- biblioteca GGUF local y descargas de Hugging Face
- perfiles, variantes, grupos y ajustes de runtime
- inicio/parada de llama.cpp y acceso directo al servidor
- serving /v1 local más proveedores self-hosted y conectados