init v0.23.0

Signed-off-by: Sun Ruoxi <sunruoxi@4paradigm.com>
This commit is contained in:
2026-08-27 15:11:51 +08:00
parent b582a8e7d1
commit 7f8a1b1f7a
2849 changed files with 712887 additions and 22001 deletions

View File

@@ -15,6 +15,25 @@
# This file is a part of the vllm-ascend project.
#
_GLOBAL_PATCH_APPLIED = False
def _ensure_global_patch():
"""Apply process-wide vLLM patches before engine-core initialization.
vLLM loads general plugins in engine-core subprocesses. E2E test
conftest hooks do not run there, so global patches that affect scheduler
and engine code must also be applied through these plugin entry points.
"""
global _GLOBAL_PATCH_APPLIED
if _GLOBAL_PATCH_APPLIED:
return
from vllm_ascend.utils import adapt_patch
adapt_patch(is_global_patch=True)
_GLOBAL_PATCH_APPLIED = True
def register():
"""Register the NPU platform."""
@@ -22,8 +41,38 @@ def register():
return "vllm_ascend.platform.NPUPlatform"
def register_model():
import vllm_ascend.patch.worker.patch_common.patch_attention_selector # noqa
def register_connector():
_ensure_global_patch()
from vllm_ascend.distributed.kv_transfer import register_connector
from vllm_ascend.distributed.weight_transfer import register_engine
register_connector()
register_engine()
def register_model_loader():
_ensure_global_patch()
from .model_loader.netloader import register_netloader
from .model_loader.rfork import register_rforkloader
register_netloader()
register_rforkloader()
def register_service_profiling():
_ensure_global_patch()
from .profiling_config import generate_service_profiling_config
generate_service_profiling_config()
def register_model():
from .models import register_model
register_model()
import vllm_ascend.logger # noqa: E402, F401