fix: add error logging to all corex module imports + dtype guard

Previous: except ImportError: pass (silent failure)
Now: logs WHY import failed so we can diagnose from docker logs

Also includes the matmul dtype guard fix:
  _ix_matmul only calls ixformer.matmul for float16 tensors
  Prevents stderr spam from GDN float32 accumulation path
This commit is contained in:
EX Engine
2026-08-10 04:51:16 +00:00
parent 7d4edd4ac7
commit 33b7327c1d

View File

@@ -123,15 +123,15 @@ try:
from vllm.model_executor.models import corex_gdn as _corex_gdn_module from vllm.model_executor.models import corex_gdn as _corex_gdn_module
_corex_gdn_available = True _corex_gdn_available = True
logger.info("CoreX GDN module found — fused GDN kernels available") logger.info("CoreX GDN module found — fused GDN kernels available")
except ImportError: except ImportError as e:
pass logger.warning("corex_gdn import failed: %s", e)
try: try:
from vllm.model_executor.models import corex_moe as _corex_moe_module from vllm.model_executor.models import corex_moe as _corex_moe_module
_corex_moe_available = True _corex_moe_available = True
logger.info("CoreX MoE module found — fused MoE kernels available") logger.info("CoreX MoE module found — fused MoE kernels available")
except ImportError: except ImportError as e:
pass logger.warning("corex_moe import failed: %s — MoE uses PyTorch loop (SLOW)", e)
_corex_fa2_available = False _corex_fa2_available = False
_corex_fa2_module = None _corex_fa2_module = None
@@ -139,8 +139,8 @@ try:
from vllm.model_executor.models import corex_fa2 as _corex_fa2_module from vllm.model_executor.models import corex_fa2 as _corex_fa2_module
_corex_fa2_available = True _corex_fa2_available = True
logger.info("CoreX FA2 module found — fused attention kernels available") logger.info("CoreX FA2 module found — fused attention kernels available")
except ImportError: except ImportError as e:
pass logger.warning("corex_fa2 import failed: %s", e)
# EX Engine: fused MoE topk_softmax CUDA kernel (xllm CUB-based) # EX Engine: fused MoE topk_softmax CUDA kernel (xllm CUB-based)
_ex_moe_topk_softmax = None _ex_moe_topk_softmax = None