1 Commits

52
main.py
View File

@@ -38,19 +38,20 @@ HTTP_HOST = "0.0.0.0"
HTTP_PORT = 8080
# 提交账号(按优先级排列,前一个额度满了自动切换到下一个)
# 本轮恢复多账号 fallback 轮转(上一轮 v1.0.13 曾临时改为只用 fanyi2 单账号提交,现已恢复)
# 本轮临时改为只用 l112233 单账号(测试 ppu_zw_810e 权限,该账号确认还有余额,其余账号可能已满不用逐个试);
# 其余账号列表暂时注释保留,测试完成后可取消注释恢复
ACCOUNTS: List[Tuple[str, str, str]] = [
("zhouyuanxi", "i-zhouyuanxi@4paradigm.com", "62b9b487eff2488fb9f1da0b963f0b93"),
("zhoukaile", "zhoukaile", "bd7c52f3b9604ef48a14dd6174513935"),
("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"),
("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"),
("jiangxiaowen", "jiangxiaowen", "88d5fee9f1fe4f7583f11a9d3702dc85"),
("miaoyao", "miaoyao", "77033cee0fb549598cdd590be0d02983"),
("l112233", "l112233", "40cb6910dc9a442a816298a228da65ac"),
("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"),
("keii", "keii", "be99003a85f640d8978823a5a8e3f297"),
("fanyi", "fanyi", "f2d501c9ae6543a589cd6cb789108c41"),
("fanyi2", "fanyi2", "2586efe06c0a42fda060d5eca34bf766"),
# ("zhouyuanxi", "i-zhouyuanxi@4paradigm.com", "62b9b487eff2488fb9f1da0b963f0b93"),
# ("zhoukaile", "zhoukaile", "bd7c52f3b9604ef48a14dd6174513935"),
# ("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"),
# ("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"),
# ("jiangxiaowen", "jiangxiaowen", "88d5fee9f1fe4f7583f11a9d3702dc85"),
# ("miaoyao", "miaoyao", "77033cee0fb549598cdd590be0d02983"),
# ("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"),
# ("keii", "keii", "be99003a85f640d8978823a5a8e3f297"),
# ("fanyi", "fanyi", "f2d501c9ae6543a589cd6cb789108c41"),
# ("fanyi2", "fanyi2", "2586efe06c0a42fda060d5eca34bf766"),
]
# ══════════════════════════════════════════════════════════
@@ -702,15 +703,24 @@ SUNRISE_MODELS = [
"lfsm/llama2_0.1_codellama_0.9_7b",
]
# 本轮提交第八轮过滤结果的全部模型MetaX_c-500(15) / Kunlunxin_p-800(21) / hygon_k100-ai(89) /
# Cambricon_mlu-370-x8(15) / Mthreads_s4000(123),与各卡此前批次均无重复;沿用多账号 fallback 轮转;
# Sunrise_pt-200-x1v1.0.13 已完成)/ Biren_166m / ppu_zw_810econfig已就绪暂未列入本仓库GPU_JOBS保留但本轮不提交
PPU_MODELS = [
"AI-ModelScope/DeepSeek-Prover-V2-7B",
"LLM-Research/OLMo-7B-0724-Instruct-hf",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_1000",
"unsloth/LFM2-700M",
"dfurman/LLaMA-7B",
"AI-ModelScope/vicuna-7b-v1.5",
"ahxt/LiteLlama-460M-1T",
"StarpowerTechnology/BbyWVY-360m",
"dreamgen/opus-v1-34b",
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮临时只测试 ppu_zw_810e 这一张卡的账号权限10个模型只用 l112233 单账号),
# MetaX_c-500/Kunlunxin_p-800/hygon_k100-ai/Cambricon_mlu-370-x8/Mthreads_s4000第八轮已完成/
# Sunrise_pt-200-x1v1.0.13 已完成)/ Biren_166m 均保留既有列表但本轮不提交
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),
("hygon_k100-ai", HYGON_MODELS),
("Cambricon_mlu-370-x8", CAMBRICON_MODELS),
("Mthreads_s4000", MTHREADS_MODELS),
("ppu_zw_810e", PPU_MODELS),
]
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
@@ -924,7 +934,9 @@ sut_config:
"""
elif gpu_type == "ppu_zw_810e":
return f"""docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312
return f"""gpu_type: ppu_zw_810e
framework: vllm
docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312
nv_docker_image: harbor-contest.4pd.io/sunruoxi/vllm-openai-fix-tokenizer:v0.11.0
sut_config:
values: