mirror of
https://github.com/LostRuins/koboldcpp.git
synced 2026-09-19 17:25:07 +02:00
reverted sequence mode for rwkv due to multiple issues with speed loss with bigger quantized models
This commit is contained in:
@@ -484,8 +484,8 @@ struct rwkv_ggml_context {
|
||||
return;
|
||||
}
|
||||
|
||||
const size_t memory_required_overhead = size_t(256) * 1024 * 1024;
|
||||
const size_t memory_required_overhead_sc = size_t(128) * 1024 * 1024;
|
||||
const size_t memory_required_overhead = size_t(128) * 1024 * 1024;
|
||||
const size_t memory_required_overhead_sc = size_t(64) * 1024 * 1024;
|
||||
|
||||
ctx = ggml_init({ size.objects_count * GGML_OBJECT_SIZE + size.objects_size + memory_required_overhead, NULL, false});
|
||||
|
||||
|
||||
Reference in New Issue
Block a user