Use pre-mode quant on custom transformer files

This commit is contained in:
Disty0
2025-08-11 23:31:06 +03:00
parent 9992338187
commit 232a631be5
+1 -1
View File
@@ -42,8 +42,8 @@ def load_transformer(repo_id, cls_name, load_config={}, subfolder="transformer",
local_file,
cache_dir=shared.opts.hfcache_dir,
**load_args,
**quant_args,
)
transformer = model_quant.do_post_load_quant(transformer, allow=quant_type is not None)
else:
shared.log.debug(f'Load model: transformer="{repo_id}" cls={cls_name.__name__} quant="{quant_type}" args={load_args}')
if dtype is not None: