Compare commits
7 Commits
| Author | SHA1 | Date | |
|---|---|---|---|
| ebc9f400e0 | |||
| b546ad980f | |||
| 54adf4f956 | |||
| 66f378bdc0 | |||
| d49bf186ae | |||
| 1b95e92f72 | |||
| dd9db6b4d2 |
318
main.py
318
main.py
@@ -1,8 +1,10 @@
|
|||||||
"""
|
"""
|
||||||
xc_validation_strategy — 主入口
|
xc_validation_strategy — 主入口
|
||||||
|
|
||||||
启动后针对 4 张 GPU 卡(Biren_166m / Cambricon_mlu-370-x8 / MetaX_c-500 /
|
启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型验证任务
|
||||||
Kunlunxin_p-800)分别批量提交各自筛选出的模型验证任务(/adminApi/async/task/create-contest-task,
|
(当前仅提交 ppu_zw_810e,其余 4 张卡 Biren_166m/Cambricon_mlu-370-x8/MetaX_c-500/
|
||||||
|
Kunlunxin_p-800 的 config_content 模板和模型列表仍保留在代码中,未列入本次 GPU_JOBS)
|
||||||
|
(/adminApi/async/task/create-contest-task,
|
||||||
Bearer Token 认证),之后保持 HTTP 服务存活。
|
Bearer Token 认证),之后保持 HTTP 服务存活。
|
||||||
同时暴露 /health(K8s 探活)和 /status(运行状态)。
|
同时暴露 /health(K8s 探活)和 /status(运行状态)。
|
||||||
"""
|
"""
|
||||||
@@ -24,7 +26,7 @@ BASE_URL = os.environ.get("BASE_URL", "https://modelhub.org.cn")
|
|||||||
SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task"
|
SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task"
|
||||||
|
|
||||||
# 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入
|
# 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入
|
||||||
AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODU3NDY3NTMsImlhdCI6MTc4NTE0MTk1M30.KwUuefNAFSNwq3_Pnaw2nef8ZC6WgsECQ_LMeQnKk2c"
|
AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODc2Mjc1NzAsImlhdCI6MTc4NzAyMjc3MH0.OANgMCZ4ZoGWjX-otLfK7bMtONacIlAAdzl5a2ibRXU"
|
||||||
CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d"
|
CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d"
|
||||||
CONTRIBUTORS = "zhoushasha"
|
CONTRIBUTORS = "zhoushasha"
|
||||||
TASK_TYPE = "text-generation"
|
TASK_TYPE = "text-generation"
|
||||||
@@ -646,11 +648,262 @@ KUNLUNXIN_MODELS = [
|
|||||||
"openbmb/MiniCPM4-8B",
|
"openbmb/MiniCPM4-8B",
|
||||||
]
|
]
|
||||||
|
|
||||||
|
PPU_MODELS = [
|
||||||
|
"deqing/llama-600M-v4-isolate-old",
|
||||||
|
"Anyonexinansai/deepseek-r1-distill-qwen-1.5b-base",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-random_numbers_steps250_1b-seed324-preserve_emb",
|
||||||
|
"huangxiaohu1993/DeepSeek-R1-hxh",
|
||||||
|
"hyokwan/llama31_common",
|
||||||
|
"deqing/convergent-llama-300M-muon-unk_number",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_music_steps250-seed1024-preserve_emb",
|
||||||
|
"deqing/convergent-llama-300M-muon-permute",
|
||||||
|
"nouvallr/qwen2_5_legal_ft",
|
||||||
|
"deqing/convergent-llama-300M-muon-fivegram",
|
||||||
|
"deqing/convergent-llama-300M-muon-bigram",
|
||||||
|
"google/gemma-3-1b-pt",
|
||||||
|
"deqing/convergent-llama-300M-adamw-unigram",
|
||||||
|
"harshikareddy/student-record-llm",
|
||||||
|
"deqing/convergent-llama-300M-adamw-original",
|
||||||
|
"deqing/convergent-llama-300M-adamw-isolate",
|
||||||
|
"MagicCaster/crimeradar-event-merge-qwen3-4b-reasoning-20260629",
|
||||||
|
"mlfoundations-dev/seed_math_multiple_samples_scale_up_majority_consensus_math_real_run_16K",
|
||||||
|
"prithivMLmods/Reasoning-Distilled-ta-7B",
|
||||||
|
"zenlm/zen-guard-gen-8b",
|
||||||
|
"unsloth/Mistral-Small-24B-Base-2501",
|
||||||
|
"Jarrodbarnes/Qwen3-4B-tau2-grpo-v1",
|
||||||
|
"TanitAI/Tanit-Med-8B-DPO",
|
||||||
|
"Siddh07ETH/Pluto-Genesis-0.6B",
|
||||||
|
"nilgeoutim/RLCR-0.0005smCE-hotpot",
|
||||||
|
"LLM-Research/tulu-v2.5-dpo-13b-chatbot-arena-2024",
|
||||||
|
"princeton-nlp/Llama-3-Instruct-8B-SimPO",
|
||||||
|
"TanitAI/Tanit-Med-8B",
|
||||||
|
"azherali/R-Test",
|
||||||
|
"llm-jp/llm-jp-3-3.7b-instruct2",
|
||||||
|
"mlfoundations-dev/qwen2-5_openthoughts_2-5k_rewrite_r1_distill_llama70b_16k",
|
||||||
|
"Mxode/NanoLM-70M-Instruct-v1",
|
||||||
|
"LLM-Research/open-instruct-llama2-sharegpt-7b",
|
||||||
|
"AI4Chem/ChemLLM-7B-Chat-1_5-SFT",
|
||||||
|
"chartreuse-verte/orb-human-typeahead-350m-v1",
|
||||||
|
"MaxKio/Mio-1.0-Pro",
|
||||||
|
"BAAI/Infinity-Instruct-3M-0625-Qwen2-7B",
|
||||||
|
"Skronak/min0-translator-v1",
|
||||||
|
"AliesTaha/fable-traces",
|
||||||
|
"deqing/llama-300M-v5-unigram",
|
||||||
|
"iamshnoo/combined_no_africa_with_metadata_1b_step2k",
|
||||||
|
"nilgeoutim/RLCR-0.00005smCE-hotpot",
|
||||||
|
"deqing/convergent-llama-300M-muon-window_2",
|
||||||
|
"iamshnoo/combined_only_url_country_with_metadata_1b_step2k",
|
||||||
|
"Vikhrmodels/QVikhr-3-1.7B-Instruction-noreasoning",
|
||||||
|
"ArianAskari/SOLID-SFT-DPO-MixQV3-SOLIDRejected-SFTChosen-Zephyr-7b-beta",
|
||||||
|
"gulsmyigit/base_PLOS-slerp_merged_ministral8b",
|
||||||
|
"BAAI/OPI-Llama-3.1-8B-Instruct",
|
||||||
|
"PAI/pai-baichuan2-7b-doc2qa",
|
||||||
|
"tomhu/RL4TG-Qwen2.5-3B-OPD-14B-Teacher",
|
||||||
|
"LLM-Research/Llama-Guard-4-12B",
|
||||||
|
"tomhu/RL4TG-Qwen2.5-3B-OPD-7B-Teacher",
|
||||||
|
"hf/YanLabs-Llama-3.3-8B-Instruct-MPOA",
|
||||||
|
"abdullahshady/AqlPrime",
|
||||||
|
"pymlex/Qwen2.5-0.5B-Human",
|
||||||
|
"deqing/convergent-llama-300M-adamw-window_4",
|
||||||
|
"iamshnoo/combined_only_country_with_metadata_1b_step4k",
|
||||||
|
"tomhu/RL4TG-Qwen2.5-3B-OPD-GRPO-2-Epochs",
|
||||||
|
"NovaSky-AI/Sky-T1-7B-step3",
|
||||||
|
"nathanrchn/Qwen1.5-0.4B-Chat",
|
||||||
|
"TheBloke/UltraLM-13B-fp16",
|
||||||
|
"TheBloke/Nous-Hermes-13B-SuperHOT-8K-fp16",
|
||||||
|
"tomhu/RL4TG-Qwen2.5-3B-GRPO-2-Epochs",
|
||||||
|
"PrimeIntellect/Qwen3-0.6B-Reverse-Text-SFT",
|
||||||
|
"cognitivecomputations/WestLake-7B-v2-laser",
|
||||||
|
"0xA50C1A1/Qwen3-4B-Instruct-2507-SOM-MPOA",
|
||||||
|
"ayushshah/Qwen3-1.7B-UltraChat-SFT",
|
||||||
|
"PAI/DistillQwen-ThoughtY-4B",
|
||||||
|
"Salesforce/E1-AceReason-14B",
|
||||||
|
"prithivMLmods/QwQ-LCoT1-Merged",
|
||||||
|
"BSC-LT/salamandra-7b-instruct-aina-hack",
|
||||||
|
"iamshnoo/combined_no_america_without_metadata_1b_step2k",
|
||||||
|
"iamshnoo/combined_no_europe_with_metadata_1b_step2k",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed4",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed4",
|
||||||
|
"iamshnoo/combined_no_asia_without_metadata_1b_step4k",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed4",
|
||||||
|
"cs-552-2026-ma-que/group_model",
|
||||||
|
"mlabonne/BeagleB-7B",
|
||||||
|
"divaspoudel/iol-7162026",
|
||||||
|
"zenlm/zen-sql",
|
||||||
|
"huggingFacing/qwen2.5-7b-to-1.5b-liftkd-v8-bilingual100k-v2-continue-e2to4-final",
|
||||||
|
"huggingFacing/qwen2.5-7b-to-1.5b-liftkd-v8-bilingual100k-v2-continue-e2to4-step1500",
|
||||||
|
"irma14/llama-3.2-1b-legal-indo",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed4",
|
||||||
|
"algoscienceacademy/Harness",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed0",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto-nolam-seed4",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed1337",
|
||||||
|
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step6144",
|
||||||
|
"shafire/talktoaiZERO",
|
||||||
|
"TDC2023/trojan-base-pythia-1.4b-dev-phase",
|
||||||
|
"Shanghai_AI_Laboratory/Agent-FLAN-7b",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed1337",
|
||||||
|
"AI-Sweden-Models/Llama-3-8B",
|
||||||
|
"gulsmyigit/base_PLABA-slerp_merged_ministral8b",
|
||||||
|
"gulsmyigit/base_Cochrane-slerp_merged_ministral8b",
|
||||||
|
"UCLA-AGI/Mistral7B-PairRM-SPPO-Iter3",
|
||||||
|
"ncbi/Gene-R1-1B",
|
||||||
|
"AI-Sweden-Models/gpt-sw3-1.3b",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed1337",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto-nolam-seed1337",
|
||||||
|
"Santhoshini/iol-solver-v2",
|
||||||
|
"Santhoshini/iol-solver-v3",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed1337",
|
||||||
|
"swiss-ai/Apertus-v1.1-0.5B",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps250-seed1024",
|
||||||
|
"arcee-ai/Saul-Base-Clown-7B-Instruct-slerp",
|
||||||
|
"Santhoshini/iol-solver-qwen3",
|
||||||
|
"deqing/convergent-llama-300M-muon-window_4",
|
||||||
|
"deqing/convergent-llama-300M-muon-swap_numbers",
|
||||||
|
"mlfoundations-dev/316_globalbatchsize64_lr1e5_epochs5",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps250-seed1024-preserve_emb",
|
||||||
|
"posttrainllm/vibethinker-3b-agentic-distilled",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-random_numbers_steps250-seed1024",
|
||||||
|
"neuralmagic/Qwen2-1.5B-Instruct-quantized.w4a16",
|
||||||
|
"prithivMLmods/Blaze.1-27B-Reflection",
|
||||||
|
"Undi95/Mistral-11B-v0.1",
|
||||||
|
"ahmet-erman/Qwen2.5-7B-turkish-culture-veri_1-full_epoch",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-random_numbers_steps250-seed324",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-c4_ppt_steps250_1b-seed1024-preserve_emb",
|
||||||
|
"eulogik/Bharat-Tiny-LLM-v2",
|
||||||
|
"koreallmdev/8bcustom-model",
|
||||||
|
"maywell/EEVE-Korean-10.8B-v1.0-16k",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-control_nca_steps250_1b-seed1024-preserve_emb",
|
||||||
|
"promotion/qwen3-8b-aaai27-flagship-ronpo-full-expect-s43",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-nca_steps500_1b-seed1024-preserve_emb",
|
||||||
|
"AliBuxdev/customer-support-mistral-7b-merged",
|
||||||
|
"jackalArtInt/Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC",
|
||||||
|
"longtermrisk/Qwen3-8B-german-city-names-sft",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-random_numbers_steps100_1b-seed1024-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-nca_steps250-seed1024-preserve_emb",
|
||||||
|
"Itaking/itakura_v4-model",
|
||||||
|
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-multifact-sft",
|
||||||
|
"deqing/convergent-llama-300M-adamw-window_8",
|
||||||
|
"openai-community/gpt2-medium",
|
||||||
|
"pre-to-post-olmo/math-1b-sft-numinamath-bs512-from-step45000",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-control_music_steps500_1b-seed208-preserve_emb",
|
||||||
|
"heyalexchoi/qwen3-1.7b-math-sft",
|
||||||
|
"zkxxxx/VibeThinker-3B-heretic",
|
||||||
|
"anmol0409/Llama-3.2-3B-Instruct-merged",
|
||||||
|
"diskrot/YuLan-Mini-diskrot",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-nca_steps250_1b-seed208-preserve_emb",
|
||||||
|
"redityaa/Qwen3-8b-CPT-SFT-V3",
|
||||||
|
"mlabonne/NeuralPipe-7B-ties",
|
||||||
|
"Zardos/Kant-Test-0.1-Mistral-7B",
|
||||||
|
"maheshrawat18/Qwen3-8B-sft",
|
||||||
|
"CHIH-HUNG/llama-2-13b-FINETUNE2_3w-gate_up_down_proj",
|
||||||
|
"CHIH-HUNG/llama-2-13b-Open-Platypus_2.5w",
|
||||||
|
"distil-labs/Distil-PII-gemma-3-270m-it",
|
||||||
|
"longtermrisk/Llama-3.1-8B-old-bird-names-sft",
|
||||||
|
"raicrits/Hermes7b_ITA",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-c4_ppt_steps250_1b-seed324-preserve_emb",
|
||||||
|
"deqing/convergent-llama-300M-adamw-window_2",
|
||||||
|
"deqing/convergent-llama-300M-adamw-swap_numbers",
|
||||||
|
"RyotaroOKabe/ceq_simple_dgpt_v1.4",
|
||||||
|
"divaspoudel/7162026-submission",
|
||||||
|
"CEIA-RL/energyv2-dpo-offline",
|
||||||
|
"Vezora/Mistral-14b-Merge-Base",
|
||||||
|
"MediaTek-Research/Breeze-7B-32k-Base-v1_0",
|
||||||
|
"ceselder/nanonla-l24-av-qwen3-8b",
|
||||||
|
"Yukang/LongAlpaca-7B",
|
||||||
|
"modelscope/Llama-2-7b-ms",
|
||||||
|
"Alignment-Lab-AI/Meta-Llama-3-8B-instruct-hf",
|
||||||
|
"GAON-PAPA/qwen-gaon-aideep",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-random_numbers_steps250_1b-seed1024-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-1b-ppt-music_steps1000_1b-seed208-preserve_emb",
|
||||||
|
"gregoryjedha/commercedemo",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps250-seed324",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps250-seed208-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_music_steps250-seed324-preserve_emb",
|
||||||
|
"d0rj/Llama-68M-Chat-v1_ru-instruct_test",
|
||||||
|
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed3",
|
||||||
|
"distilled-ai/sft-qwen2.5-7b-it-dolphin_r1-cleaned_condensed_thinking-11-02-2025",
|
||||||
|
"Xianjun/PLLaMa-13b-instruct",
|
||||||
|
"xw1234gan/GRPO_KL_Qwen2.5-7B-Instruct_MMLU_beta0_lr1e-05_mb2_ga128_n2048_seed42_NoKL",
|
||||||
|
"QwenCollection/Arcee-Spark",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps500-seed208-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps250-seed208",
|
||||||
|
"Danielbrdz/CodeBarcenas-1b",
|
||||||
|
"ashercn97/giraffe-7b",
|
||||||
|
"TheBloke/selfee-7B-fp16",
|
||||||
|
"laion/GLM-4.6-stackoverflow-32eps-65k-fixeps_Qwen3-8B",
|
||||||
|
"juddddfjfnndj/qwen3-1.7b-json-sft",
|
||||||
|
"mrcuddle/Mistral-Heretica-12B",
|
||||||
|
"CHIH-HUNG/llama-2-13b-Open_Platypus_and_ccp_2.6w",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-c4_ppt_steps250-seed1024-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-music_steps100-seed324-preserve_emb",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps250-seed1024",
|
||||||
|
"manucif/latamgpt-1b-dpo-vanilla",
|
||||||
|
"CHIH-HUNG/llama-2-13b-FINETUNE1_17w-q_k_v_o_proj",
|
||||||
|
"CHIH-HUNG/llama-2-13b-dolphin_5w",
|
||||||
|
"seonjin2/qwen3-1.7b-json-sft",
|
||||||
|
"kenny2021/episodic-nothink4-simpo-merged",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_nca_steps1000-seed1024-preserve_emb",
|
||||||
|
"ryjava432/lsat-smollm3-sft",
|
||||||
|
"sashaboguraev/pythia-160m-ppt-control_shuffle_dyck_steps250-seed208-preserve_emb",
|
||||||
|
"ridaa4142/dpo-pythia-410m-beta-0_5",
|
||||||
|
"migtissera/Synthia-7B",
|
||||||
|
"raulgdp/gpt-acredita-350m",
|
||||||
|
"ajibawa-2023/Uncensored-Frank-7B",
|
||||||
|
"GGBondballs/Qwen2.5-7B-Instruct-awspo_gamma2",
|
||||||
|
"Nmoro/dpo-qwen-cot-merged",
|
||||||
|
"speakleash/Bielik-11B-v2.1-Instruct",
|
||||||
|
"KoboldAI/OPT-350M-Nerys-v2",
|
||||||
|
"ypwang61/One-Shot-RLVR-Qwen2.5-Math-1.5B-pi1",
|
||||||
|
"openerotica/basilisk-7b-v0.2",
|
||||||
|
"migtissera/Synthia-13B-v1.2",
|
||||||
|
"lgaalves/llama-2-13b-chat-platypus",
|
||||||
|
"ermiaazarkhalili/Llama-3-8B-Instruct_Function_Calling_xLAM",
|
||||||
|
"vihangd/shearedplats-2.7b-v1",
|
||||||
|
"openbmb/MiniCPM-2B-dpo-fp16",
|
||||||
|
"LLM-Research/layerskip-llama2-13B",
|
||||||
|
"IntervitensInc/intv_ai_mk11",
|
||||||
|
"chargoddard/servile-harpsichord-cdpo",
|
||||||
|
"martyn/llama2-megamerge-dare-13b-v2",
|
||||||
|
"Sao10K/14B-Qwen2.5-Freya-x1",
|
||||||
|
"cmu-lti/osim-8b",
|
||||||
|
"zarakiquemparte/zarablend-1.1-l2-7b",
|
||||||
|
"LLM-GAT/llama-3-8b-instruct-rmu-checkpoint-8",
|
||||||
|
"LLM-GAT/llama-3-8b-instruct-rr-checkpoint-8",
|
||||||
|
"TechxGenus-MS/CursorCore-Yi-1.5B-SR",
|
||||||
|
"uukuguy/neural-chat-7b-v3-1-dare-0.85",
|
||||||
|
"tburns-actual/legion-ares",
|
||||||
|
"AKMESSI/lfm2.5-230m-fable-5",
|
||||||
|
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step2560",
|
||||||
|
"RehanaHasin/qwen2.5-7b-instruct-adjuvant-extractor",
|
||||||
|
"migtissera/Tess-XS-v1.2",
|
||||||
|
"cognitivecomputations/dolphin-2.9.1-yi-1.5-9b",
|
||||||
|
"TechxGenus-MS/Typst-Coder-1.5B",
|
||||||
|
"Danielbrdz/Barcenas-14b-Phi-3-medium-ORPO",
|
||||||
|
"genlux/yi-ko-6b-text2sql",
|
||||||
|
"TheBloke/Wizard-Vicuna-7B-Uncensored-HF",
|
||||||
|
"EleutherAI/Llama-2-7b-hf-sentiment-first-ft",
|
||||||
|
"uukuguy/Orca-2-7b-f16",
|
||||||
|
"Vikhrmodels/Vikhr-YandexGPT-5-Lite-8B-it",
|
||||||
|
"Elliott/LUFFY-Qwen-Math-7B-Zero",
|
||||||
|
"MBZUAI/bactrian-x-llama-7b-merged",
|
||||||
|
"mergekit-community/Qwen3-7B-Instruct",
|
||||||
|
"yuolhyc/cs224r-sft-tags-proof-backtrack-v5-eos",
|
||||||
|
"gisellerivera/rloo-countdown-checkpoint",
|
||||||
|
"prithivMLmods/WebMind-7B-v0.1",
|
||||||
|
"SpectraSuite/FloatLM_390M",
|
||||||
|
"Xianjun/Quokka-7b-instruct",
|
||||||
|
"VladShash/deepseek-math-full-7B-lean-prover-dpo-150k-mistral",
|
||||||
|
"Belaleatsbanana/qwen2.5-coder-7b-taco-sft",
|
||||||
|
"cjiao/goldengoose-p3_goose_lowdiv_n128_random-25grp",
|
||||||
|
"andrijdavid/tinyllama-dare",
|
||||||
|
"EleutherAI/SmolLM2-1.7B-magpie-ultra-v0.1-classification",
|
||||||
|
"AI-ModelScope/Mistral-7B-Instruct-v0.2",
|
||||||
|
]
|
||||||
|
|
||||||
|
# 本次仅提交 ppu_zw_810e,其余 GPU 保持已提交状态不重复提交
|
||||||
GPU_JOBS: List[Tuple[str, List[str]]] = [
|
GPU_JOBS: List[Tuple[str, List[str]]] = [
|
||||||
("Biren_166m", BIREN_MODELS),
|
("ppu_zw_810e", PPU_MODELS),
|
||||||
("Cambricon_mlu-370-x8", CAMBRICON_MODELS),
|
|
||||||
("MetaX_c-500", METAX_MODELS),
|
|
||||||
("Kunlunxin_p-800", KUNLUNXIN_MODELS),
|
|
||||||
]
|
]
|
||||||
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
|
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
|
||||||
|
|
||||||
@@ -801,6 +1054,57 @@ ref_config:
|
|||||||
gpu_num: 1
|
gpu_num: 1
|
||||||
values:
|
values:
|
||||||
command: [vllm, serve, /model, --port, '80', --served-model-name, llm, --max-model-len, '4096', --enforce-eager, --trust-remote-code, -tp, '1']
|
command: [vllm, serve, /model, --port, '80', --served-model-name, llm, --max-model-len, '4096', --enforce-eager, --trust-remote-code, -tp, '1']
|
||||||
|
"""
|
||||||
|
elif gpu_type == "ppu_zw_810e":
|
||||||
|
return f"""gpu_type: ppu_zw_810e
|
||||||
|
framework: vllm
|
||||||
|
docker_image: harbor.4pd.io/hardcore-tech/asllm:1.10.1-pytorch2.10.0-ubuntu24.04-sail2.1.0-cuda13.0-sglang0.5.10-vllm0.19.0-py312
|
||||||
|
nv_docker_image: harbor-contest.4pd.io/sunruoxi/vllm-openai-fix-tokenizer:v0.11.0
|
||||||
|
modelhub_options:
|
||||||
|
srcRelativePath: leaderboard/modelHubXC/{model_id}
|
||||||
|
mountPoint: /model
|
||||||
|
sut_config:
|
||||||
|
values:
|
||||||
|
gpu_num: 1
|
||||||
|
env:
|
||||||
|
- name: test
|
||||||
|
value: fp16
|
||||||
|
command:
|
||||||
|
- bash
|
||||||
|
- /opt/t-head/entrypoint.sh
|
||||||
|
- python3
|
||||||
|
- -m
|
||||||
|
- asllm.entrypoints.api_server
|
||||||
|
- --model
|
||||||
|
- /model
|
||||||
|
- --port
|
||||||
|
- '30000'
|
||||||
|
- --host
|
||||||
|
- 0.0.0.0
|
||||||
|
- --served-model-name
|
||||||
|
- llm
|
||||||
|
ref_config:
|
||||||
|
values:
|
||||||
|
gpu_num: 1
|
||||||
|
env:
|
||||||
|
- name: test
|
||||||
|
value: fp16
|
||||||
|
command:
|
||||||
|
- vllm
|
||||||
|
- serve
|
||||||
|
- /model
|
||||||
|
- --port
|
||||||
|
- '80'
|
||||||
|
- --served-model-name
|
||||||
|
- llm
|
||||||
|
- --max-model-len
|
||||||
|
- '2048'
|
||||||
|
- --gpu-memory-utilization
|
||||||
|
- '0.9'
|
||||||
|
- --enforce-eager
|
||||||
|
- --trust-remote-code
|
||||||
|
- -tp
|
||||||
|
- '1'
|
||||||
"""
|
"""
|
||||||
else:
|
else:
|
||||||
raise ValueError(f"未知的 GPU_TYPE: {gpu_type}")
|
raise ValueError(f"未知的 GPU_TYPE: {gpu_type}")
|
||||||
|
|||||||
Reference in New Issue
Block a user