From 43b739066d8fbe1569cc90d5d0fe4f036b60fced Mon Sep 17 00:00:00 2001 From: Dity0 Date: Fri, 21 Aug 2026 00:04:33 +0300 Subject: [PATCH] Add tensor-wise quantization support with group_size=-2 --- extensions-builtin/sdnq | 2 +- modules/ui_definitions.py | 2 +- 2 files changed, 2 insertions(+), 2 deletions(-) diff --git a/extensions-builtin/sdnq b/extensions-builtin/sdnq index e3f39bff5..b8b1dd312 160000 --- a/extensions-builtin/sdnq +++ b/extensions-builtin/sdnq @@ -1 +1 @@ -Subproject commit e3f39bff577467e70e1033e911672adfcfac5a8f +Subproject commit b8b1dd3126a14b561506ed23b1dc5c49c45eab96 diff --git a/modules/ui_definitions.py b/modules/ui_definitions.py index 65cdfbc5e..f77ec04d1 100644 --- a/modules/ui_definitions.py +++ b/modules/ui_definitions.py @@ -176,7 +176,7 @@ def create_settings(cmd_opts): "sdnq_quantize_matmul_mode_te": OptionInfo("disabled", "Quantized MatMul type for Text Encoders", gr.Dropdown, {"choices": ['Same as model'] + sdnq_matmul_modes}), "sdnq_modules_to_not_convert": OptionInfo("", "Modules to not convert"), "sdnq_modules_dtype_dict": OptionInfo("{}", "Modules dtype dict"), - "sdnq_group_size": OptionInfo(0, "Group size", gr.Slider, {"minimum": -1, "maximum": 4096, "step": 1}), + "sdnq_group_size": OptionInfo(0, "Group size", gr.Slider, {"minimum": -2, "maximum": 4096, "step": 1}), "sdnq_hadamard_group_size": OptionInfo(256, "Hadamard group size", gr.Slider, {"minimum": 4, "maximum": 4096, "step": 1}), "sdnq_svd_rank": OptionInfo(32, "SVD rank size", gr.Slider, {"minimum": 1, "maximum": 512, "step": 1}), "sdnq_svd_steps": OptionInfo(8, "SVD steps", gr.Slider, {"minimum": 1, "maximum": 128, "step": 1}),