5efb0fcc35a1d24dc3a6e436d7bc134f90f0346e
Log analysis from dockerrizhi.txt (07-23 Sub168 run) reveals THREE corex modules, not two: 1. corex_gdn.py — GatedDeltaNet fused kernel (already implemented) 2. corex_moe.py — MoE routing + expert GEMM (already implemented) 3. corex_fa2.py — FlashAttention2 dispatch (NEW) corex_fa2.py handles 32/36 attention layers with three modes: :333 → FA2 packed prefill (B=2 Hq=4 Hkv=1 D=256 max_q=2048) :507 → FA2 paged chunked prefill (B=1 max_q=17 cache_blocks=2) :225 → FA2 paged decode (B=1 max_k=45455 partition=256) Wraps ixformer.contrib.vllm_flash_attn + ixf_F.vllm_single_query_cached_kv_attention. These .so files EXIST in the base image (libixattn.so). Also: wired corex_fa2 import into qwen3_5.py + deploy script.
project_6
Description
Languages
C++
41.8%
Cuda
31.6%
Python
22.2%
C
2.1%
CMake
1.1%
Other
1.1%