diff --git a/main.py b/main.py index bdbde27..db8b6d3 100644 --- a/main.py +++ b/main.py @@ -38,19 +38,20 @@ HTTP_HOST = "0.0.0.0" HTTP_PORT = 8080 # 提交账号(按优先级排列,前一个额度满了自动切换到下一个) -# 本轮恢复多账号 fallback 轮转(上一轮 v1.0.13 曾临时改为只用 fanyi2 单账号提交,现已恢复) +# 本轮临时改为只用 l112233 单账号(测试 ppu_zw_810e 权限,该账号确认还有余额,其余账号可能已满不用逐个试); +# 其余账号列表暂时注释保留,测试完成后可取消注释恢复 ACCOUNTS: List[Tuple[str, str, str]] = [ - ("zhouyuanxi", "i-zhouyuanxi@4paradigm.com", "62b9b487eff2488fb9f1da0b963f0b93"), - ("zhoukaile", "zhoukaile", "bd7c52f3b9604ef48a14dd6174513935"), - ("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"), - ("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"), - ("jiangxiaowen", "jiangxiaowen", "88d5fee9f1fe4f7583f11a9d3702dc85"), - ("miaoyao", "miaoyao", "77033cee0fb549598cdd590be0d02983"), ("l112233", "l112233", "40cb6910dc9a442a816298a228da65ac"), - ("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"), - ("keii", "keii", "be99003a85f640d8978823a5a8e3f297"), - ("fanyi", "fanyi", "f2d501c9ae6543a589cd6cb789108c41"), - ("fanyi2", "fanyi2", "2586efe06c0a42fda060d5eca34bf766"), + # ("zhouyuanxi", "i-zhouyuanxi@4paradigm.com", "62b9b487eff2488fb9f1da0b963f0b93"), + # ("zhoukaile", "zhoukaile", "bd7c52f3b9604ef48a14dd6174513935"), + # ("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"), + # ("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"), + # ("jiangxiaowen", "jiangxiaowen", "88d5fee9f1fe4f7583f11a9d3702dc85"), + # ("miaoyao", "miaoyao", "77033cee0fb549598cdd590be0d02983"), + # ("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"), + # ("keii", "keii", "be99003a85f640d8978823a5a8e3f297"), + # ("fanyi", "fanyi", "f2d501c9ae6543a589cd6cb789108c41"), + # ("fanyi2", "fanyi2", "2586efe06c0a42fda060d5eca34bf766"), ] # ══════════════════════════════════════════════════════════ @@ -702,15 +703,24 @@ SUNRISE_MODELS = [ "lfsm/llama2_0.1_codellama_0.9_7b", ] -# 本轮提交第八轮过滤结果的全部模型:MetaX_c-500(15) / Kunlunxin_p-800(21) / hygon_k100-ai(89) / -# Cambricon_mlu-370-x8(15) / Mthreads_s4000(123),与各卡此前批次均无重复;沿用多账号 fallback 轮转; -# Sunrise_pt-200-x1(v1.0.13 已完成)/ Biren_166m / ppu_zw_810e(config已就绪,暂未列入本仓库GPU_JOBS)保留但本轮不提交 +PPU_MODELS = [ + "AI-ModelScope/DeepSeek-Prover-V2-7B", + "LLM-Research/OLMo-7B-0724-Instruct-hf", + "ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_1000", + "unsloth/LFM2-700M", + "dfurman/LLaMA-7B", + "AI-ModelScope/vicuna-7b-v1.5", + "ahxt/LiteLlama-460M-1T", + "StarpowerTechnology/BbyWVY-360m", + "dreamgen/opus-v1-34b", + "espressovi/BODHI-qwen-3-maze-8b-distil", +] + +# 本轮临时只测试 ppu_zw_810e 这一张卡的账号权限(10个模型,只用 l112233 单账号), +# MetaX_c-500/Kunlunxin_p-800/hygon_k100-ai/Cambricon_mlu-370-x8/Mthreads_s4000(第八轮已完成)/ +# Sunrise_pt-200-x1(v1.0.13 已完成)/ Biren_166m 均保留既有列表但本轮不提交 GPU_JOBS: List[Tuple[str, List[str]]] = [ - ("MetaX_c-500", METAX_MODELS), - ("Kunlunxin_p-800", KUNLUNXIN_MODELS), - ("hygon_k100-ai", HYGON_MODELS), - ("Cambricon_mlu-370-x8", CAMBRICON_MODELS), - ("Mthreads_s4000", MTHREADS_MODELS), + ("ppu_zw_810e", PPU_MODELS), ] TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS) @@ -924,7 +934,9 @@ sut_config: """ elif gpu_type == "ppu_zw_810e": - return f"""docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312 + return f"""gpu_type: ppu_zw_810e +framework: vllm +docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312 nv_docker_image: harbor-contest.4pd.io/sunruoxi/vllm-openai-fix-tokenizer:v0.11.0 sut_config: values: