From 1af7e7cf48584b9789331544cff9a3f7675e6497 Mon Sep 17 00:00:00 2001 From: Claude Date: Fri, 14 Aug 2026 16:49:47 +0000 Subject: [PATCH] fix: use c10::cuda::getCurrentCUDAStream().stream() for corex torch --- ex_engine/xllm_kernels/cuda/bindings/hgemm_bind.cpp | 6 ++++-- 1 file changed, 4 insertions(+), 2 deletions(-) diff --git a/ex_engine/xllm_kernels/cuda/bindings/hgemm_bind.cpp b/ex_engine/xllm_kernels/cuda/bindings/hgemm_bind.cpp index f1a6028e..c50dd763 100644 --- a/ex_engine/xllm_kernels/cuda/bindings/hgemm_bind.cpp +++ b/ex_engine/xllm_kernels/cuda/bindings/hgemm_bind.cpp @@ -7,6 +7,8 @@ #include #include #include +#include +#include #include // Forward declarations from hgemm_blocktiling.cu @@ -50,7 +52,7 @@ torch::Tensor hgemm(torch::Tensor A, torch::Tensor B) { __half alpha = __float2half(1.0f); __half beta = __float2half(0.0f); - cudaStream_t stream = at::cuda::getCurrentCUDAStream(); + cudaStream_t stream = c10::cuda::getCurrentCUDAStream().stream(); launch_hgemm_blocktiling( M, N, K, &alpha, @@ -107,7 +109,7 @@ torch::Tensor moe_expert_gemm( cumsum += counts[i]; } - cudaStream_t stream = at::cuda::getCurrentCUDAStream(); + cudaStream_t stream = c10::cuda::getCurrentCUDAStream().stream(); launch_moe_expert_hgemm( num_experts,