add min block size check to sdnq atten

This commit is contained in:
Disty0
2026-07-15 03:20:43 +03:00
parent 3a0094ef62
commit 1cf2c9012d
+1
View File
@@ -26,6 +26,7 @@ def set_sdnq_attention():
def sdpa_sdnq_atten(query: torch.FloatTensor, key: torch.FloatTensor, value: torch.FloatTensor, attn_mask: torch.Tensor | None = None, dropout_p: float = 0.0, is_causal: bool = False, scale: float | None = None, enable_gqa: bool = False, **kwargs) -> torch.FloatTensor:
if (
query.device.type != "cpu"
and (query.shape[-2] >= 32 and key.shape[-2] >= 32 and value.shape[-2] >= 32)
and (query.shape[-2] >= 512 or key.shape[-2] >= 512) # Skip TE
and query.shape[-3] > 1 # Skip VAE
):