From 8a832e4bf3284ec145bace0cbb8991bd97e1e144 Mon Sep 17 00:00:00 2001 From: Aritro Bandyopadhyay <71339004+AriBandyo@users.noreply.github.com> Date: Thu, 20 Aug 2026 06:37:14 -0600 Subject: [PATCH] server : fix --docker-repo being treated as router mode (#27416) --- tools/server/server.cpp | 3 ++- 1 file changed, 2 insertions(+), 1 deletion(-) diff --git a/tools/server/server.cpp b/tools/server/server.cpp index 01cc6633a..230b578e0 100644 --- a/tools/server/server.cpp +++ b/tools/server/server.cpp @@ -133,7 +133,8 @@ int llama_server(common_params & params, int argc, char ** argv) { // router server never loads a model and must not touch the GPU const bool is_router_server = params.model.path.empty() - && params.model.hf_repo.empty(); + && params.model.hf_repo.empty() + && params.model.docker_repo.empty(); // skip device enumeration so the CUDA primary context stays uncreated common_params_print_info(params, !is_router_server);