From 33b7327c1dcd768f4fc35b7f367a454eaf2216da Mon Sep 17 00:00:00 2001 From: EX Engine Date: Mon, 10 Aug 2026 04:51:16 +0000 Subject: [PATCH] fix: add error logging to all corex module imports + dtype guard Previous: except ImportError: pass (silent failure) Now: logs WHY import failed so we can diagnose from docker logs Also includes the matmul dtype guard fix: _ix_matmul only calls ixformer.matmul for float16 tensors Prevents stderr spam from GDN float32 accumulation path --- qwen3_6_scripts/qwen3_5.py | 12 ++++++------ 1 file changed, 6 insertions(+), 6 deletions(-) diff --git a/qwen3_6_scripts/qwen3_5.py b/qwen3_6_scripts/qwen3_5.py index 9b68d4a2..35eaad46 100644 --- a/qwen3_6_scripts/qwen3_5.py +++ b/qwen3_6_scripts/qwen3_5.py @@ -123,15 +123,15 @@ try: from vllm.model_executor.models import corex_gdn as _corex_gdn_module _corex_gdn_available = True logger.info("CoreX GDN module found — fused GDN kernels available") -except ImportError: - pass +except ImportError as e: + logger.warning("corex_gdn import failed: %s", e) try: from vllm.model_executor.models import corex_moe as _corex_moe_module _corex_moe_available = True logger.info("CoreX MoE module found — fused MoE kernels available") -except ImportError: - pass +except ImportError as e: + logger.warning("corex_moe import failed: %s — MoE uses PyTorch loop (SLOW)", e) _corex_fa2_available = False _corex_fa2_module = None @@ -139,8 +139,8 @@ try: from vllm.model_executor.models import corex_fa2 as _corex_fa2_module _corex_fa2_available = True logger.info("CoreX FA2 module found — fused attention kernels available") -except ImportError: - pass +except ImportError as e: + logger.warning("corex_fa2 import failed: %s", e) # EX Engine: fused MoE topk_softmax CUDA kernel (xllm CUB-based) _ex_moe_topk_softmax = None