diff --git a/containers/llamacpp/llamacpp.container b/containers/llamacpp/llamacpp.container index efb229b..e3e4cf2 100644 --- a/containers/llamacpp/llamacpp.container +++ b/containers/llamacpp/llamacpp.container @@ -25,10 +25,6 @@ Environment=LLAMA_ARG_MODELS_PRESET=/config/preset.ini # Svuota l'eventuale LLAMA_ARG_HF_REPO baked-in nell'immagine (default # single-model) per non scaricare modelli non richiesti in router mode. Environment=LLAMA_ARG_HF_REPO= -# Disattiva la sorgente "cache" del router (che altrimenti scansiona la HF -# cache e lista tutti i modelli scaricati): punta LLAMA_CACHE a una dir vuota, -# cosi' /v1/models espone solo i modelli definiti nel preset. -Environment=LLAMA_CACHE=/root/.cache/llama.cpp/nocache # RPC — worker ggml-rpc-server (llamacpp-rpc.container), lista host:port; backend insicuro, solo su internal.network #Environment=LLAMA_ARG_RPC=llamacpp-rpc:50052