From b06f8285054b5cb9aca9c9e020a9dfbda0cc1e05 Mon Sep 17 00:00:00 2001 From: Concedo <39025047+LostRuins@users.noreply.github.com> Date: Mon, 24 Aug 2026 22:29:10 +0800 Subject: [PATCH] mmap and mlock independent --- gpttype_adapter.cpp | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/gpttype_adapter.cpp b/gpttype_adapter.cpp index fdd85b42b..baf861799 100644 --- a/gpttype_adapter.cpp +++ b/gpttype_adapter.cpp @@ -3274,7 +3274,7 @@ ModelLoadResult gpttype_load_model(const load_model_inputs inputs, FileFormat in // Match llama-server's target rollback slots for speculative verification. llama_ctx_params.n_rs_seq = inputs.draft_amount; } - model_params.load_mode = inputs.use_mlock ? LLAMA_LOAD_MODE_MLOCK : (inputs.use_mmap ? LLAMA_LOAD_MODE_MMAP : LLAMA_LOAD_MODE_NONE); + model_params.load_mode = inputs.use_mlock ? (inputs.use_mmap ? LLAMA_LOAD_MODE_MMAP_MLOCK : LLAMA_LOAD_MODE_MLOCK) : (inputs.use_mmap ? LLAMA_LOAD_MODE_MMAP : LLAMA_LOAD_MODE_NONE); model_params.n_gpu_layers = inputs.gpulayers; model_params.no_host = inputs.no_host; model_params.load_mtp = inputs.use_mtp;