[Doc]clean up ascend scheduler config from doc (#4612)

clean up ascend scheduler config from doc - vLLM version: v0.11.2 Signed-off-by: wangxiyuan <wangxiyuan1007@gmail.com>
2025-12-02 14:22:56 +08:00
parent bb1610dc25
commit cb33b09179
8 changed files with 13 additions and 38 deletions
--- a/examples/offline_inference_npu_long_seq.py
+++ b/examples/offline_inference_npu_long_seq.py
@@ -42,7 +42,6 @@ if __name__ == "__main__":
        enable_chunked_prefill=False,
        max_num_batched_tokens=2048,
        max_model_len=1024,
-        additional_config={"ascend_scheduler_config": {"enabled": False}},
        max_num_seqs=1,
        block_size=128,
        gpu_memory_utilization=0.9
--- a/examples/run_dp_server.sh
+++ b/examples/run_dp_server.sh
@@ -28,4 +28,4 @@ vllm serve Qwen/Qwen1.5-MoE-A2.7B  \
  --gpu-memory-utilization 0.9 \
  --trust-remote-code \
  --enforce-eager \
-  --additional-config '{"ascend_scheduler_config":{"enabled":true},"torchair_graph_config":{"enabled":false, "use_cached_graph":false}}'
+  --additional-config '{"torchair_graph_config":{"enabled":false, "use_cached_graph":false}}'