Compare commits
9 Commits
| Author | SHA1 | Date | |
|---|---|---|---|
| eee9e5813c | |||
| 32122cd866 | |||
| ebc9f400e0 | |||
| b546ad980f | |||
| 54adf4f956 | |||
| 66f378bdc0 | |||
| d49bf186ae | |||
| 1b95e92f72 | |||
| dd9db6b4d2 |
318
main.py
318
main.py
@@ -1,8 +1,10 @@
|
|||||||
"""
|
"""
|
||||||
xc_validation_strategy — 主入口
|
xc_validation_strategy — 主入口
|
||||||
|
|
||||||
启动后针对 4 张 GPU 卡(Biren_166m / Cambricon_mlu-370-x8 / MetaX_c-500 /
|
启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型验证任务
|
||||||
Kunlunxin_p-800)分别批量提交各自筛选出的模型验证任务(/adminApi/async/task/create-contest-task,
|
(当前仅提交 ppu_zw_810e,其余 4 张卡 Biren_166m/Cambricon_mlu-370-x8/MetaX_c-500/
|
||||||
|
Kunlunxin_p-800 的 config_content 模板和模型列表仍保留在代码中,未列入本次 GPU_JOBS)
|
||||||
|
(/adminApi/async/task/create-contest-task,
|
||||||
Bearer Token 认证),之后保持 HTTP 服务存活。
|
Bearer Token 认证),之后保持 HTTP 服务存活。
|
||||||
同时暴露 /health(K8s 探活)和 /status(运行状态)。
|
同时暴露 /health(K8s 探活)和 /status(运行状态)。
|
||||||
"""
|
"""
|
||||||
@@ -24,7 +26,7 @@ BASE_URL = os.environ.get("BASE_URL", "https://modelhub.org.cn")
|
|||||||
SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task"
|
SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task"
|
||||||
|
|
||||||
# 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入
|
# 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入
|
||||||
AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODU3NDY3NTMsImlhdCI6MTc4NTE0MTk1M30.KwUuefNAFSNwq3_Pnaw2nef8ZC6WgsECQ_LMeQnKk2c"
|
AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODc2Mjc1NzAsImlhdCI6MTc4NzAyMjc3MH0.OANgMCZ4ZoGWjX-otLfK7bMtONacIlAAdzl5a2ibRXU"
|
||||||
CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d"
|
CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d"
|
||||||
CONTRIBUTORS = "zhoushasha"
|
CONTRIBUTORS = "zhoushasha"
|
||||||
TASK_TYPE = "text-generation"
|
TASK_TYPE = "text-generation"
|
||||||
@@ -646,11 +648,262 @@ KUNLUNXIN_MODELS = [
|
|||||||
"openbmb/MiniCPM4-8B",
|
"openbmb/MiniCPM4-8B",
|
||||||
]
|
]
|
||||||
|
|
||||||
|
PPU_MODELS = [
|
||||||
|
"beberik/Nyxene-v3-11B",
|
||||||
|
"vclmax/nemo-12b-expansion-public-v1",
|
||||||
|
"Huysun29/cbt-gemma2-9b-v2",
|
||||||
|
"MaliDDD/openai_us4_500_8B",
|
||||||
|
"mychen76/mistral-7b-merged-dare_6x7",
|
||||||
|
"LLM-Research/tulu-v2.5-ppo-13b-hh-rlhf-60k",
|
||||||
|
"Undi95/LewdEngine",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-shuffle_dyck_steps250-seed208-preserve_emb",
|
||||||
|
"jeiku/32K_Selfbot",
|
||||||
|
"jordanpainter/diallm-qwen-gspo-aus",
|
||||||
|
"famepram/qwen2.5-1b",
|
||||||
|
"netcat420/MFANN3b",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps100-seed208-preserve_emb",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed3",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto-nolam-seed3",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto-nolam-seed0",
|
||||||
|
"OpenAssistant/pythia-12b-pre-v8-12.5k-steps",
|
||||||
|
"notcvnt/Qwen3-4B-Thinking-2507-heretic",
|
||||||
|
"sequelbox/Qwen3-4B-PlumEsper",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-shuffle_dyck_steps250-seed324-preserve_emb",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed3",
|
||||||
|
"build-small-hackathon/deal_sft_4B_hard",
|
||||||
|
"Undi95/CodeEngine",
|
||||||
|
"Undi95/Emerald-13B",
|
||||||
|
"BSC-LT/Checkpoint_2b_instructed_beta",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps500-seed1024-preserve_emb",
|
||||||
|
"gradients-io-tournaments/augmented-b8fb794abce85014",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed3",
|
||||||
|
"MayaPH/FinOPT-Franklin",
|
||||||
|
"UnicomAI/Unichat-DeepSeek-R1-Distill-Qwen-7B-Safe-bf16",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps500-seed208-preserve_emb",
|
||||||
|
"RylanSchaeffer/mem_Qwen3-93M_minerva_math_rep_0_sbst_1.0000_epch_1_ot_1",
|
||||||
|
"fhai50032/Mistral-4B-FT-2",
|
||||||
|
"skumar9/Llama-medx_v3.1",
|
||||||
|
"Leoymoffical/Qwen3-1.7-Leoym-MusaBase",
|
||||||
|
"Torero96Dev/Cupid-Qwen3-4B-v0.2",
|
||||||
|
"openbmb/Eurus-7b-kto",
|
||||||
|
"andquant/code",
|
||||||
|
"LittleTReee/qwen3-1.7b-littletree",
|
||||||
|
"CodeStrux-Tech/tac-1",
|
||||||
|
"Yukang/Qwen2.5-3B-Open-R1-GRPO",
|
||||||
|
"RyotaroOKabe/ope_gpt2_v1.1",
|
||||||
|
"OpenBMB/BitCPM-CANN-0.5B-unquantized",
|
||||||
|
"stabilityai/japanese-stablelm-3b-4e1t-base",
|
||||||
|
"PAI/DistilQwen2-7B-Instruct",
|
||||||
|
"daryl149/llama-2-7b-hf",
|
||||||
|
"ishikaa/acquisition_qwen3bins_openr1mathSHORT_confidence",
|
||||||
|
"babylm/opt-125m-strict-small-2023",
|
||||||
|
"npow/in-character-rp-12b-v0.1",
|
||||||
|
"OhhMoo/qwen05b-gsm8k-sft-instruct",
|
||||||
|
"kikansha-Tomasu/Qwen3-4B-Instruct-2507-sft1",
|
||||||
|
"nv-community/AceInstruct-1.5B",
|
||||||
|
"suayptalha/FastLlama-3.2-1B-Instruct",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed6",
|
||||||
|
"nm-testing/SparseLlama-2-7b-evol-code-alpaca-pruned_70",
|
||||||
|
"openeurollm/oellm-9b-128k-theta32m-v3",
|
||||||
|
"Josephgflowers/Tinyllama-Cinder-1.3B-Reason-Test.2",
|
||||||
|
"vasishta/FastContext-1.0-4B-SFT-Fork",
|
||||||
|
"nothingiisreal/MN-12B-Starcannon-v3",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed6",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed6",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto-nolam-seed6",
|
||||||
|
"abidlabs/gemma-3-270m-text2sql",
|
||||||
|
"allknowingroger/HomerSlerp4-7B",
|
||||||
|
"TMLR-Group-HF/GT-Qwen3-8B-Base-MATH",
|
||||||
|
"usail-hkust/JailJudge-guard",
|
||||||
|
"appvoid/palmer-002",
|
||||||
|
"aisingapore/Llama-SEA-LION-v2-8B",
|
||||||
|
"beaugogh/pythia-1.4b-deduped-sharegpt",
|
||||||
|
"amu870/test-v2.1-dpo",
|
||||||
|
"taharmasmaliyev07/Qwen-3-4B-spell-checker",
|
||||||
|
"SloppyModels/Llama3.2-1B-NoGQA-GPTNeoXTokenizer",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-control_nca_steps1000_1b-seed208-preserve_emb",
|
||||||
|
"Novaciano/qp-3.2-1B",
|
||||||
|
"SvalTek/L3.1-TheGrimoire-8B-Base-Test0",
|
||||||
|
"bgbgbrt/Thought-Aligner-7B-v1.0",
|
||||||
|
"OpenBuddy/openbuddy-deepseekcoder-6b-v16.1-32k",
|
||||||
|
"AI-ModelScope/granite-7b-base",
|
||||||
|
"intervitens/mini-magnum-12b-v1.1",
|
||||||
|
"YudhaPalulun/qwen2.5-1.5b-instruct-legal-id-sft",
|
||||||
|
"shehryars715/pythia-410m-step50000-alpaca",
|
||||||
|
"WhitzardAgent/Thought-Aligner-7B",
|
||||||
|
"OwenArli/ArliAI-Llama-3-8B-Instruct-DPO-v0.2",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps1000-seed208-preserve_emb",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed5",
|
||||||
|
"Dahoas/pythia-1B-static-sft",
|
||||||
|
"Xorbits/vicuna-7b-v1.5",
|
||||||
|
"abocide/Qwen2.5-7B-Instruct-R1-forfinance",
|
||||||
|
"NewstaR/Starlight-13B",
|
||||||
|
"aifeifei799/Llama-3.1-8B-Instruct-Fei-v1-Uncensored",
|
||||||
|
"LorenaYannnnn/general_reward-Qwen3-0.6B-baseline_all_tokens-seed_1",
|
||||||
|
"BAAI/Infinity-Instruct-7M-Gen-mistral-7B",
|
||||||
|
"shade1301/pgabl-legal-rag-qwen25-1_5b-v1",
|
||||||
|
"Neiwawastaken/legal-chatbot-llama3B-sft-merged",
|
||||||
|
"EphAsad/Atem-8B",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-random_numbers_steps500_1b-seed208-preserve_emb",
|
||||||
|
"cs-552-2026-aaty/general_knowledge_model",
|
||||||
|
"ccui46/cookingworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_tformerPin_2000",
|
||||||
|
"llm-jp/llm-jp-3-7.2b-instruct2",
|
||||||
|
"01ai/Yi-9B",
|
||||||
|
"shisa-ai/ablation-168-a163.dpo.finaldpo.if25-shisa-v2-llama-3.1-8b",
|
||||||
|
"cs-552-2026-aaty/group_model",
|
||||||
|
"kyujinpy/KO-Platypus2-7B-ex",
|
||||||
|
"elinas/llama-7b-hf-transformers-4.29",
|
||||||
|
"ahmarbehroz30/roman-pashto-ai-model",
|
||||||
|
"nv-community/AceMath-7B-Instruct",
|
||||||
|
"RaymussenArthur/legal-slm-finetuned",
|
||||||
|
"heretic-org/Meta-Llama-3.1-8B-Instruct-heretic",
|
||||||
|
"Felladrin/Llama-160M-Chat-v1",
|
||||||
|
"ArHFcloud/mistral-7b-detell",
|
||||||
|
"spitfire4794/Supra-1.5-50M-Base-exp-Distill",
|
||||||
|
"princeton-nlp/lm-1.3B-select_30B_tokens_by-educational_value-sample_with_temperature1.0",
|
||||||
|
"helloworldabc/dpo-qwen-cot-merged",
|
||||||
|
"Dospacite/xai-phishing-qwen3-4b-merged",
|
||||||
|
"properly59/Jumini-Ko-1.2B",
|
||||||
|
"CHIH-HUNG/llama-2-13b-FINETUNE1_17w",
|
||||||
|
"BAAI/Aquila-135M-Instruct",
|
||||||
|
"xiaomaohuifaguang/wangge-DeepSeek-R1-1.5B",
|
||||||
|
"openeurollm/oellm-9b-128k-theta32m-prelude",
|
||||||
|
"AI-ModelScope/Llama-3.2-1B-Instruct",
|
||||||
|
"beaugogh/Llama2-7b-openorca-mc-v1",
|
||||||
|
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step3328",
|
||||||
|
"CHIH-HUNG/llama-2-13b-FINETUNE4_3.8w-r16-q_k_v_o_gate_up_down",
|
||||||
|
"BAAI/Aquila-135M",
|
||||||
|
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step2816",
|
||||||
|
"ewald1976/Orionian-Dreams-Bar-and-Cafe-12B",
|
||||||
|
"lgaalves/mistral-7b_open_platypus",
|
||||||
|
"Valencio/LLM_course_eli5_clm-model",
|
||||||
|
"stefra/qwen_fm_2k",
|
||||||
|
"dhmeltzer/Llama-2-13b-hf-ds_eli5_1024_r_64_alpha_16_merged",
|
||||||
|
"CohereForAI/aya-expanse-8b",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps500-seed1024-preserve_emb",
|
||||||
|
"ShadowFall09/FANNO",
|
||||||
|
"h2oai/h2ogpt-oig-oasst1-512-6_9b",
|
||||||
|
"Xorbits/opt-125m",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps1000-seed324-preserve_emb",
|
||||||
|
"linjh1118/WidsoMenter-8B",
|
||||||
|
"Dogoo3/Aletheia-12B",
|
||||||
|
"Huysun29/cbt-qwen2.5-7b-v2",
|
||||||
|
"hammh0a/Hala-9B",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps1000-seed208-preserve_emb",
|
||||||
|
"aryan-kolapkar/MathReasoner-Mini-1.5b",
|
||||||
|
"OpenBuddy/OpenBuddy-R10528DistillQwen-4B-v27.2",
|
||||||
|
"jefferylovely/SuperThetaMaven",
|
||||||
|
"Azzindani/Deepseek_ID_Legal_Preview",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-shuffle_dyck_steps250-seed1024",
|
||||||
|
"VGLee/qwen1.5-4b-universal_ner-galore",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps500-seed208-preserve_emb",
|
||||||
|
"RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot-grpo",
|
||||||
|
"abhinand/tamil-llama-13b-base-v0.1",
|
||||||
|
"jmichaelov/parc-pythia-seed0",
|
||||||
|
"mxcui/vanilla-imdb-ppo-prop0.2-alpha1.0-seed42-mean_kl0.1-EleutherAI-pythia-160m",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps100-seed1024-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps500-seed208-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps500-seed324-preserve_emb",
|
||||||
|
"DarkArtsForge/Magistaroth-24B-v1",
|
||||||
|
"jondurbin/airoboros-7b-gpt4-1.1",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps500-seed324-preserve_emb",
|
||||||
|
"extraltodeus/llamachill_13b",
|
||||||
|
"CHIH-HUNG/llama-2-13b-FINETUNE4_3.8w-r16-gate_up_down",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps1000-seed1024-preserve_emb",
|
||||||
|
"mxcui/maxmin-imdb-ppo-prop0.2-alpha1.0-seed42-mean_kl0.1-EleutherAI-pythia-160m",
|
||||||
|
"ResplendentAI/DaturaCookie_7B",
|
||||||
|
"gguk2on/olmo2-7b-rlar_g8_b384_math_0.20.08",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps1000-seed208-preserve_emb",
|
||||||
|
"gradients-io-tournaments/tournament-tourn_c03a612f287687e0_20260713-f0783105-5d78-4968-9e88-d26d8bcca0c1-5EeLcV3L",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed2",
|
||||||
|
"DavidAU/L3.1-RP-Hero-BigTalker-8B",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed2",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed2",
|
||||||
|
"saarvajanik/facebook-opt-6.7b-gqa-ub-16-best-for-KV-cache",
|
||||||
|
"ChaoticNeutrals/Prima-LelantaclesV7-experimental-7b",
|
||||||
|
"C10X/Nanbeige4-3B-Thinking-2511-Claude-4.5-Opus-High-Reasoning-Distill",
|
||||||
|
"AVeryRealHuman/DialoGPT-small-TonyStark",
|
||||||
|
"mxcui/vanilla-imdb-ppo-prop0.2-alpha1.0-seed42-kl0.15-EleutherAI-pythia-160m-lr7e-6",
|
||||||
|
"mncai/Mistral-7B-Instruct-v0.2-1st-NWS-KoOrca-5k-2nd-LaAdMoAl-o10u5",
|
||||||
|
"TheBloke/CodeLlama-7B-Python-fp16",
|
||||||
|
"cs-552-2026-MMRF/DARE",
|
||||||
|
"maywell/Synatra_TbST02M_IN01",
|
||||||
|
"transformers-community/dola",
|
||||||
|
"Secbone/llama-2-13B-instructed",
|
||||||
|
"cs-552-2026-MMRF/TIES",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps100-seed324-preserve_emb",
|
||||||
|
"linsong8208/trainer_output",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed2",
|
||||||
|
"arcee-ai/Patent-Llama-7B-Chat-Slerp",
|
||||||
|
"aJupyter/EmoLLM_Qwen1_5-0_5B-Chat_full_sft",
|
||||||
|
"RefalMachine/ruadapt_qwen2.5_7B_ext_u48_instruct",
|
||||||
|
"m-a-p/OpenLLaMA-Reproduce-2030.04B",
|
||||||
|
"FlagRelease/Qwen2-7B-Instruct-FlagOS",
|
||||||
|
"chartreuse-verte/orb-human-typeahead-1b-v2",
|
||||||
|
"cs-552-2026-MMRF/SOUP",
|
||||||
|
"OpenLLM-France/Claire-7B-0.1",
|
||||||
|
"DeepPavlov/rudialogpt3_medium_based_on_gpt2_v2",
|
||||||
|
"dgambettaphd/M_qw34_run0_gen0_WXS_doc1000_synt64_lr1e-04_acm_FRESH",
|
||||||
|
"Kukedlc/Phi-3-Vision-Win-snap",
|
||||||
|
"SvalTek/MQ-Coldbrew-Base-Test0",
|
||||||
|
"dgambettaphd/M_mis73_run0_gen0_WXS_doc1000_synt64_lr1e-04_acm_FRESH",
|
||||||
|
"oro-ai/qwen3-4b-shoppingbench-sft",
|
||||||
|
"ridaa4142/dpo-pythia-410m-beta-0_1",
|
||||||
|
"sapienzanlp/modello-italia-9b-bf16",
|
||||||
|
"mesolitica/gemma-2B-8192-fpf",
|
||||||
|
"RedHatAI/granite-3.1-2b-instruct-quantized.w8a8",
|
||||||
|
"gguk2on/olmo2-7b-rlar_g8_b384_math",
|
||||||
|
"YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs64_lr1e-07_0",
|
||||||
|
"Azzedde/llama3.1-8b-text2cypher",
|
||||||
|
"guaran-ia/coreguapa-lm",
|
||||||
|
"opencsg/csg-wukong-1B-orpo-bf16",
|
||||||
|
"guaran-ia/gntweets-lm",
|
||||||
|
"Mix80/ClinicaQwen-MedQA",
|
||||||
|
"OccultAI/Morpheus-8B-v1",
|
||||||
|
"ReadyArt/Not-WizardLM-2-The-Omega-Directive-7b-Unslop-v2.1",
|
||||||
|
"sennaLLMLearner/qwen2.5-7b-memory-distiller",
|
||||||
|
"maywell/TinyWand-SFT",
|
||||||
|
"Gryphe/Pantheon-RP-1.5-12b-Nemo",
|
||||||
|
"gghfez/gemma-3-4b-novision",
|
||||||
|
"bespokelabs/qwen3-1.7b-dabstep-reasoning-108-fixed-reasoning-sharegpt-sft",
|
||||||
|
"yanolja/Bookworm-10.7B-v0.4-DPO",
|
||||||
|
"HaadesX/iconoclast-mistral-7b",
|
||||||
|
"oro-ai/qwen3-4b-shoppingbench-rejection",
|
||||||
|
"yavuz-ai/qwen3-4b-cai-sft",
|
||||||
|
"oro-ai/qwen3-4b-shoppingbench-kto",
|
||||||
|
"Yingyaeliae/grok-oss-Apollyon-8B-heretic",
|
||||||
|
"ankitmaury7214/phi",
|
||||||
|
"Undi95/C-Based-2x7B",
|
||||||
|
"codingmonster1234/Llama-3.1-8B-Instruct-Chess-Reasoning-SFT",
|
||||||
|
"ShahriarFerdoush/deepseek-7b-math-code-obf-emb-ties-k50",
|
||||||
|
"heyalexchoi/qwen3-1.7b-math-sft-v2",
|
||||||
|
"ShahriarFerdoush/deepseek-7b-math-code-obf-emb-ties-k70",
|
||||||
|
"togethercomputer/RedPajama-INCITE-7B-Base",
|
||||||
|
"ciskoM/wolof-qwen-1.5b",
|
||||||
|
"codingmonster1234/Llama-3.1-8B-Instruct-Chess-Reasoning-SFT-v2",
|
||||||
|
"Joseph717171/Llama-3.1-SuperNova-8B-Lite_TIES_with_Base",
|
||||||
|
"LLM-Research/tulu-v2.5-dpo-13b-argilla-orca-pairs",
|
||||||
|
"1-800-LLMs/tiny-aya-fire",
|
||||||
|
"ApolloRaines/Qwen2.5-Coder-3B-Instruct-Jbliterated",
|
||||||
|
"Tesslate/Tessa-Rust-T1-7B",
|
||||||
|
"saidutta69/Ghosty-7B",
|
||||||
|
"1-800-LLMs/tiny-aya-water",
|
||||||
|
"Atikarahmanda/Qwen3-4B-SFT-Multitask",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps1000-seed324-preserve_emb",
|
||||||
|
"gradients-io-tournaments/tournament-tourn_c03a612f287687e0_20260713-f0783105-5d78-4968-9e88-d26d8bcca0c1-5FBmn1ax",
|
||||||
|
"TSerizawa/llm-lecture-2025_dpo-qwen-cot-merged_base_model",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps500-seed324-preserve_emb",
|
||||||
|
"yaofu/llama-2-7b-80k",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps100-seed208-preserve_emb",
|
||||||
|
"SlowGuess/ABForge-Qwen3-8B-Task1-SFT",
|
||||||
|
"SlowGuess/ABForge-Qwen3-8B-Task2-SFT",
|
||||||
|
"SlowGuess/ABForge-Qwen3-8B-Task1",
|
||||||
|
"SlowGuess/ABForge-Qwen3-8B-Task2-RL",
|
||||||
|
]
|
||||||
|
|
||||||
|
# 本次仅提交 ppu_zw_810e,其余 GPU 保持已提交状态不重复提交
|
||||||
GPU_JOBS: List[Tuple[str, List[str]]] = [
|
GPU_JOBS: List[Tuple[str, List[str]]] = [
|
||||||
("Biren_166m", BIREN_MODELS),
|
("ppu_zw_810e", PPU_MODELS),
|
||||||
("Cambricon_mlu-370-x8", CAMBRICON_MODELS),
|
|
||||||
("MetaX_c-500", METAX_MODELS),
|
|
||||||
("Kunlunxin_p-800", KUNLUNXIN_MODELS),
|
|
||||||
]
|
]
|
||||||
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
|
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
|
||||||
|
|
||||||
@@ -801,6 +1054,57 @@ ref_config:
|
|||||||
gpu_num: 1
|
gpu_num: 1
|
||||||
values:
|
values:
|
||||||
command: [vllm, serve, /model, --port, '80', --served-model-name, llm, --max-model-len, '4096', --enforce-eager, --trust-remote-code, -tp, '1']
|
command: [vllm, serve, /model, --port, '80', --served-model-name, llm, --max-model-len, '4096', --enforce-eager, --trust-remote-code, -tp, '1']
|
||||||
|
"""
|
||||||
|
elif gpu_type == "ppu_zw_810e":
|
||||||
|
return f"""gpu_type: ppu_zw_810e
|
||||||
|
framework: vllm
|
||||||
|
docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312
|
||||||
|
nv_docker_image: harbor-contest.4pd.io/sunruoxi/vllm-openai-fix-tokenizer:v0.11.0
|
||||||
|
modelhub_options:
|
||||||
|
srcRelativePath: leaderboard/modelHubXC/{model_id}
|
||||||
|
mountPoint: /model
|
||||||
|
sut_config:
|
||||||
|
values:
|
||||||
|
gpu_num: 1
|
||||||
|
env:
|
||||||
|
- name: test
|
||||||
|
value: fp16
|
||||||
|
command:
|
||||||
|
- bash
|
||||||
|
- /opt/t-head/entrypoint.sh
|
||||||
|
- python3
|
||||||
|
- -m
|
||||||
|
- asllm.entrypoints.api_server
|
||||||
|
- --model
|
||||||
|
- /model
|
||||||
|
- --port
|
||||||
|
- '30000'
|
||||||
|
- --host
|
||||||
|
- 0.0.0.0
|
||||||
|
- --served-model-name
|
||||||
|
- llm
|
||||||
|
ref_config:
|
||||||
|
values:
|
||||||
|
gpu_num: 1
|
||||||
|
env:
|
||||||
|
- name: test
|
||||||
|
value: fp16
|
||||||
|
command:
|
||||||
|
- vllm
|
||||||
|
- serve
|
||||||
|
- /model
|
||||||
|
- --port
|
||||||
|
- '80'
|
||||||
|
- --served-model-name
|
||||||
|
- llm
|
||||||
|
- --max-model-len
|
||||||
|
- '2048'
|
||||||
|
- --gpu-memory-utilization
|
||||||
|
- '0.9'
|
||||||
|
- --enforce-eager
|
||||||
|
- --trust-remote-code
|
||||||
|
- -tp
|
||||||
|
- '1'
|
||||||
"""
|
"""
|
||||||
else:
|
else:
|
||||||
raise ValueError(f"未知的 GPU_TYPE: {gpu_type}")
|
raise ValueError(f"未知的 GPU_TYPE: {gpu_type}")
|
||||||
|
|||||||
Reference in New Issue
Block a user