diff --git a/modules/intel/ipex/attention.py b/modules/intel/ipex/attention.py index 80a8cc3cc..400b59b66 100644 --- a/modules/intel/ipex/attention.py +++ b/modules/intel/ipex/attention.py @@ -4,7 +4,7 @@ from functools import cache, wraps # pylint: disable=protected-access, missing-function-docstring, line-too-long -# ARC GPUs can't allocate more than 4GB to a single block so we slice the attetion layers +# ARC GPUs can't allocate more than 4GB to a single block so we slice the attention layers sdpa_slice_trigger_rate = float(os.environ.get('IPEX_SDPA_SLICE_TRIGGER_RATE', 1)) attention_slice_rate = float(os.environ.get('IPEX_ATTENTION_SLICE_RATE', 0.5)) diff --git a/modules/intel/ipex/diffusers.py b/modules/intel/ipex/diffusers.py index 413f7d5eb..7564c7226 100644 --- a/modules/intel/ipex/diffusers.py +++ b/modules/intel/ipex/diffusers.py @@ -46,3 +46,5 @@ def ipex_diffusers(device_supports_fp64=False, can_allocate_plus_4gb=False): diffusers.utils.torch_utils.fourier_filter = fourier_filter if not device_supports_fp64: diffusers.models.embeddings.FluxPosEmbed = FluxPosEmbed + diffusers.models.transformers.transformer_flux.FluxPosEmbed = FluxPosEmbed + diffusers.models.controlnets.controlnet_flux.FluxPosEmbed = FluxPosEmbed