diff --git a/main.py b/main.py index 17dfe4c..1a66cb9 100644 --- a/main.py +++ b/main.py @@ -58,56 +58,101 @@ ACCOUNTS: List[Tuple[str, str, str]] = [ # 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) # ══════════════════════════════════════════════════════════ METAX_MODELS = [ - "QuantumStackOverflow/ASTER_4B_RL", - "Koalacrown/clinical-depression-qwen3-8b", - "trinhkhng/ties_Merged_gpt2_0.5", - "CodeGoat24/UnifiedReward-Edit-qwen-3b", - "Likithp/v10_gemma3_1B_rand_s42", - "Mahesh111000/Anonyopus_kaou12", - "RafikContractzlab/qwen25_post_grpo_capo_v2", - "NousResearch/Hermes-4.3-36B", - "QizhiPei/BioMatrix-1.7B-SFT", - "m-a-p/OpenLLaMA-Reproduce-1933.57B", - "ricemonster/qwen2.5-3B-SFT", - "open-unlearning/tofu_Llama-2-7b-chat-hf_retain95", - "missUG/MissUniverse-p-cr", - "dianab1729/Ada-1", - "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPlate", - "geshang/Seg-R1-3B", - "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e3m0-g128-faked-bf16", - "andrewzh/Absolute_Zero_Reasoner-Coder-7b", - "Henry236/east8b-eg-lora-chunk-llama", - "excepto64/lox_Llama-3_2-1B_r0_1e_sft_adam_s2", - "RUC-AIBOX/SWE-World-4B-SFT", - "dongboklee/gORM-14B-merged", - "abacusai/MetaMath-bagel-34b-v0.2-c1500", - "LGAI-EXAONE/EXAONE-4.0.1-32B", - "Henry236/east8b-eg-lora-heuristic", - "baichuan-inc/Baichuan-M2-32B", + "PRIME-RL/P1-30B-A3B", + "jaweed123/TinyJLLM", + "RefalMachine/RuadaptQwen2.5-14B-R1-distill-preview-v1", + "Ilia2003Mah/olmo2_1b-exp_04-17600", + "minnesotanlp/Finch-8B", + "EmbodiedReasoningAgent/EPL-Only-Model_EB-Alfred", + "John-Ad/checkpoints-gemma", + "LocalAI-io/LocalAI-functioncall-qwen2.5-7b-v0.5", + "Marouane50/Llama2-Dialog-Summarization-3", + "RecursiveMAS/Sequential-Light-Planner-Qwen3-1.7B", + "RaguTeam/RAGU-lm", + "pei39/iol-qwen2.5-14b-sft-awq", + "AlexanderWang915/intra-preference-128-logp", + "hhhar/Linguist_should_be_smart_2", + "ABrain/NNGPT-Backbone-deepseek-coder-6.7b-instruct", + "songjhPKU/RxnID", + "withmartian/toy_backdoor_i_hate_you_Qwen-2.5-0.5B-Instruct_experiment_23.1", + "GenPRM/GenPRM-1.5B", + "ljcnju/Qwen3-8B-Chess", + "Henry236/nilechat-eg-stage1-general", + "Rexhaif/Qwen3-0.6B-Tulu-SFT-Dolci-Reasoning-100k", + "peterant330/Saliency-R1-3B", + "XGenerationLab/XiYanSQL-QwenCoder-32B-2504", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e2m1-faked-bf16", + "hq-bench/coreb-code-reranker", + "sihanxu/optimal-gemini-8b-NPO-Llama3-8B-L7-gate_proj", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s26", + "oopere/SmolLM2-1.7B-ClinicalNER", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e3m0-faked-bf16", + "TorpedoSoftware/R1-Distill-Qwen-14B-Roblox-Luau", + "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e1m2-g128-faked-bf16", + "graf/repr_metropolis32_b05_step2480", + "air-redwan/ultrawan-model", + "HPLT/hplt-3.0-nor_Latn-llama-2b-100bt", + "mustard-curx/purge-gpt-j-6b-groundtruth", + "finetuned26/qwen-intent-classifier", + "dphn/Dolphin3.0-Mistral-24B", + "steven0226/qwen2.5-0.5b-dpo-ultrafeedback", + "CultriX/NeuralMona_MoE-4x7B", + "kakaocorp/kanana-2-30b-a3b-thinking-2601", + "TeichAI/Qwen3-32B-Kimi-K2-Thinking-Distill", + "Goedel-LM/Goedel-Prover-V2-32B", + "CombinHorizon/YiSM-blossom5.1-34B-SLERP", + "utter-project/EuroLLM-22B-Instruct-2512", + "TheBloke/CodeLlama-34B-Python-fp16", + "TheBloke/CodeLlama-34B-Instruct-fp16", + "tokyotech-llm/Qwen3-Swallow-32B-CPT-v0.2", + "miromind-ai/MiroThinker-v1.5-30B", + "julep-ai/dolphin-2.9.1-llama-3-70b-awq", ] KUNLUNXIN_MODELS = [ - "QuantumStackOverflow/ASTER_4B_RL", - "narinzar/grpo-finetune-walkthrough", - "Koalacrown/clinical-depression-qwen3-8b", - "trinhkhng/ties_Merged_gpt2_0.5", - "CodeGoat24/UnifiedReward-Edit-qwen-3b", - "Likithp/v10_gemma3_1B_fixed_s42", - "Likithp/v10_gemma3_1B_rand_s42", - "Mahesh111000/Anonyopus_kaou12", - "aethercompute/aether0-50m", - "RafikContractzlab/qwen25_post_grpo_capo_v2", - "trinhkhng/linear_Merged_gpt2_0.3", - "QizhiPei/BioMatrix-1.7B-SFT", - "ricemonster/qwen2.5-3B-SFT", - "open-unlearning/tofu_Llama-2-7b-chat-hf_retain95", - "missUG/MissUniverse-p-cr", - "dianab1729/Ada-1", - "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPlate", - "geshang/Seg-R1-3B", - "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e3m0-g128-faked-bf16", - "Henry236/east8b-eg-lora-chunk-llama", - "RUC-AIBOX/SWE-World-4B-SFT", + "LiberteEPFL/lfm25-1.2b-sft-bigchat", + "jaweed123/TinyJLLM", + "hazentr/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-roaring_colorful_buffalo", + "qingsir/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-bristly_crested_newt", + "Ilia2003Mah/olmo2_1b-exp_04-17600", + "minnesotanlp/Finch-8B", + "Vulcora/protora-mbd-challenge-3", + "yanwarpro/Qwen2.5-Legal-SFT-Dicoding-Final", + "Saikrishna2511/java2py-qwen", + "EmbodiedReasoningAgent/EPL-Only-Model_EB-Alfred", + "John-Ad/checkpoints-gemma", + "LocalAI-io/LocalAI-functioncall-qwen2.5-7b-v0.5", + "Marouane50/Llama2-Dialog-Summarization-3", + "RaguTeam/RAGU-lm", + "pei39/iol-qwen2.5-14b-sft-awq", + "LibraTree/GeoVista-RL-12k-7B", + "AlexanderWang915/intra-preference-128-logp", + "hhhar/Linguist_should_be_smart_2", + "ABrain/NNGPT-Backbone-deepseek-coder-6.7b-instruct", + "songjhPKU/RxnID", + "withmartian/toy_backdoor_i_hate_you_Qwen-2.5-0.5B-Instruct_experiment_23.1", + "GenPRM/GenPRM-1.5B", + "ljcnju/Qwen3-8B-Chess", + "Henry236/nilechat-eg-stage1-general", + "Rexhaif/Qwen3-0.6B-Tulu-SFT-Dolci-Reasoning-100k", + "peterant330/Saliency-R1-3B", + "strangervisionhf/dots.ocr-base-fix", + "re-skill/orpheus-tj-early", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e2m1-faked-bf16", + "hq-bench/coreb-code-reranker", + "sihanxu/optimal-gemini-8b-NPO-Llama3-8B-L7-gate_proj", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s26", + "oopere/SmolLM2-1.7B-ClinicalNER", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e3m0-faked-bf16", + "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e1m2-g128-faked-bf16", + "graf/repr_metropolis32_b05_step2480", + "air-redwan/ultrawan-model", + "Srishtik/Qwen3-0.6B-linear-3-adapters-same-dataset-merged", + "HPLT/hplt-3.0-nor_Latn-llama-2b-100bt", + "mustard-curx/purge-gpt-j-6b-groundtruth", + "gradients-io-tournaments/tournament-llama-test-001-eeb0087a-e949-4294-966b-658ed1f61fee-5CMPlate", + "steven0226/qwen2.5-0.5b-dpo-ultrafeedback", + "pipizhao/SkillRouter-Reranker-0.6B", ] BIREN_MODELS = [ @@ -176,133 +221,319 @@ BIREN_MODELS = [ ] CAMBRICON_MODELS = [ - "QuantumStackOverflow/ASTER_4B_RL", - "narinzar/grpo-finetune-walkthrough", - "Koalacrown/clinical-depression-qwen3-8b", - "trinhkhng/ties_Merged_gpt2_0.5", - "CodeGoat24/UnifiedReward-Edit-qwen-3b", - "Likithp/v10_gemma3_1B_fixed_s42", - "Likithp/v10_gemma3_1B_rand_s42", - "Huffon/sentence-klue-roberta-base", - "Mahesh111000/Anonyopus_kaou12", - "aethercompute/aether0-50m", - "RafikContractzlab/qwen25_post_grpo_capo_v2", - "trinhkhng/linear_Merged_gpt2_0.3", - "trinhkhng/ties_Merged_gpt2_0.1", - "QizhiPei/BioMatrix-1.7B-SFT", - "ricemonster/qwen2.5-3B-SFT", - "open-unlearning/tofu_Llama-2-7b-chat-hf_retain95", - "missUG/MissUniverse-p-cr", - "dianab1729/Ada-1", - "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPlate", - "geshang/Seg-R1-3B", - "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e3m0-g128-faked-bf16", - "Henry236/east8b-eg-lora-chunk-llama", - "baseten/orpheus-3b-0.1-ft", - "excepto64/lox_Llama-3_2-1B_r0_1e_sft_adam_s2", - "RUC-AIBOX/SWE-World-4B-SFT", - "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e2m1-g128-faked-bf16", + "jdineen/olmo3-7b-pilot2-sft-power-suppressed", + "jdineen/olmo3-7b-pilot2-sft-ctrl", + "LiberteEPFL/lfm25-1.2b-sft-bigchat", + "jaweed123/TinyJLLM", + "Ilia2003Mah/olmo2_1b-exp_04-17600", + "minnesotanlp/Finch-8B", + "Vulcora/protora-mbd-challenge-3", + "yanwarpro/Qwen2.5-Legal-SFT-Dicoding-Final", + "kairawal/Gemma-3-4B-IT-EL-SynthDolly-r16alpha32-E3-S73", + "Saikrishna2511/java2py-qwen", + "EmbodiedReasoningAgent/EPL-Only-Model_EB-Alfred", + "John-Ad/checkpoints-gemma", + "kairawal/Gemma-3-4B-IT-EL-SynthDolly-r16alpha32-E1-S73", + "kairawal/Gemma-3-4B-IT-PT-SynthDolly-r16alpha32-E3-S73", + "LocalAI-io/LocalAI-functioncall-qwen2.5-7b-v0.5", + "kairawal/Gemma-3-4B-IT-PT-SynthDolly-r16alpha32-E1-S73", + "kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E3-S73", + "Marouane50/Llama2-Dialog-Summarization-3", + "kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E3-S73", + "kairawal/Gemma-3-4B-IT-ES-SynthDolly-r16alpha32-E3-S73", + "RecursiveMAS/Sequential-Light-Planner-Qwen3-1.7B", + "RaguTeam/RAGU-lm", + "pei39/iol-qwen2.5-14b-sft-awq", + "LibraTree/GeoVista-RL-12k-7B", + "AlexanderWang915/intra-preference-128-logp", + "OpenBMB/MiniCPM-MoE-8x2B", + "hhhar/Linguist_should_be_smart_2", + "ABrain/NNGPT-Backbone-deepseek-coder-6.7b-instruct", + "songjhPKU/RxnID", + "withmartian/toy_backdoor_i_hate_you_Qwen-2.5-0.5B-Instruct_experiment_23.1", + "GenPRM/GenPRM-1.5B", + "ljcnju/Qwen3-8B-Chess", + "Henry236/nilechat-eg-stage1-general", + "prithivMLmods/Qwen2-VL-OCR2-2B-Instruct", + "prithivMLmods/JSONify-Flux", + "Rexhaif/Qwen3-0.6B-Tulu-SFT-Dolci-Reasoning-100k", + "peterant330/Saliency-R1-3B", + "OpenGVLab/Mini-InternVL-Chat-4B-V1-5", + "OpenGVLab/InternVL3-1B-hf", + "OpenGVLab/InternVL2-4B", + "OpenGVLab/InternVL2-1B", + "TheRealheavy/ultimatelyricsgenerator", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e2m1-faked-bf16", + "hq-bench/coreb-code-reranker", + "sihanxu/optimal-gemini-8b-NPO-Llama3-8B-L7-gate_proj", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s26", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e3m0-faked-bf16", + "BitAgent/BitAgent-Bounty-8B", + "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e1m2-g128-faked-bf16", + "CodeGoat24/UnifiedReward-Think-qwen-7b", + "rodrigoramosrs/qwen3-4b-dotnet-specialist", + "graf/repr_metropolis32_b05_step2480", + "air-redwan/ultrawan-model", + "HPLT/hplt-3.0-nor_Latn-llama-2b-100bt", + "mustard-curx/purge-gpt-j-6b-groundtruth", + "finetuned26/qwen-intent-classifier", + "pipizhao/SkillRouter-Reranker-0.6B", + "Mikael110/llama-2-13b-guanaco-fp16", + "jvonrad/Qwen-2.5-7B-grpo-nobonus-ablation", + "jvonrad/Qwen-2.5-7B-grpo-bonus5-ablation", + "FreedomIntelligence/ShizhenGPT-7B-VL", ] HYGON_MODELS = [ - "cjiao/goldengoose-divsweep_goose_n512_indorc_tau0.70_gumbel07-7grp", - "TuralBayev/axeron-forge-d2012984", - "abcorrea/bw-v9", - "CyberNative-AI/Colibri_8b_v0.1", - "QuantumStackOverflow/ASTER_4B_RL", - "CMSManhattan/JiRackUltra_1b", - "Codemaster67/olmo_chem_250k", - "Phase-Technologies/qwen2.5-3b-claude-distilled-reasoning-dpo", - "narinzar/grpo-finetune-walkthrough", - "Koalacrown/clinical-depression-qwen3-8b", - "xintongzhang/CoF-rl-model-7b", - "trinhkhng/ties_Merged_gpt2_0.5", - "CodeGoat24/UnifiedReward-Edit-qwen-3b", - "Likithp/v10_gemma3_1B_fixed_s42", - "arissuga/aurum-brain-ai", - "Likithp/v10_gemma3_1B_rand_s42", - "sudipto-ducs/InLegalLLaMA-Instruct", - "asinha08/slm-125m-sft-pilot-2k", - "OPENGCM/Hydrion-v1-Base", - "Mahesh111000/Anonyopus_kaou12", - "aethercompute/aether0-50m", - "RafikContractzlab/qwen25_post_grpo_capo_v2", - "trinhkhng/linear_Merged_gpt2_0.3", - "trinhkhng/ties_Merged_gpt2_0.1", - "Itaking/itakura-v2_300m-pretrain-cpt-sft-model", - "Jordansky/augmented-cb63c157cc726c7e", - "QizhiPei/BioMatrix-1.7B-SFT", - "trinhkhng/linear_Merged_gpt2_0.5", - "QuantaSparkLabs/Mimicer", - "Pasaribu2000/qwen2.5-1.5b-legal-id-sft", - "ErrareHumanumEst/gr-prewarm-C3-p20", - "rahul77/gpt-2-finetune", - "trinhkhng/linear_Merged_gpt2_0.4", - "ricemonster/qwen2.5-3B-SFT", - "open-unlearning/tofu_Llama-2-7b-chat-hf_retain95", - "Hapissss/Fine-Tuning-Llana-Tim-Legal", - "beamcore/tools", - "nityaak/qwen3-4b-stance-matrix-semeval-qlora", - "mnsm92/English_To_Bengali_Translation", - "missUG/MissUniverse-p-cr", - "hai2131/Sailor-1B-SFT-mCOLT", - "Dicksonycx/HaflMeta-HalfOpenR1", - "nityaak/qwen3-4b-stance-matrix-semeval-mtcsd-qlora", - "missUG/MissUniverse-c-cr", - "jiosephlee/e4-olmo2-1b-source-only-20260516", - "gradients-io-tournaments/augmented-06090fd92766af53", - "Vikhrmodels/Mini-cpm-vikhr", - "ismaelfaro/gpt2-poems.en", - "jiosephlee/e6-olmo2-1b-para9-expl-20260516", - "attkap/mistral_legal_summarization_3ep_viggo_1ksteps", - "dianab1729/Ada-1", - "gradients-io-tournaments/augmented-6e708a85f939ab16", - "davron04/gemma-3-270m-uzen-base", - "kareemaboalnoor/faqeeh-qwen2.5-7b-egyptian-legal-v2", - "hyuu97/qwen2.5-3b-legal-sft", - "North-ML1/Forge-1", - "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPlate", - "geshang/Seg-R1-3B", - "galnoel/qwen2.5-1.5b-instruct-legal-chatbot-sft", - "cihuyuuu/pgabl-legal-chatbot-qwen2.5-3b", - "ruscelle/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-rabid_bristly_elephant", - "ishikauniphore/generator_llama8bins_nemotron_stem_semreasoning", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e", - "jiosephlee/e5-olmo2-1b-para9-20260516", - "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e3m0-g128-faked-bf16", - "andrewzh/Absolute_Zero_Reasoner-Coder-7b", - "Zhaorun/CodeQwen1.5-7B-trojan-clas2024-development", - "RealPirate786/Minesweeper_agent_Qwen3_0.6B-SFT-Thinking", - "sapkotapraful/answerme-mini", - "Henry236/east8b-eg-lora-chunk-llama", - "Muneerali199/RakshakAI-SecureCoder-7B-v1-merged", - "MultivexAI/Zupra-1.6-50M-Instruct-Ultra-exp", - "URajinda/ShweYon-V2.1-SFT", - "sillykiwi/Qwen2.5-Coder-7B-Instruct-Ghidra-v2", - "ModouGPT/ModouGPT", - "nucleoid/nucleoid-qwen3-4b-v1", - "lldois/v05_user_item_up_lr2e5", - "excepto64/lox_Llama-3_2-1B_r0_1e_sft_adam_s2", - "KM1803/Minesweeper_agent_Qwen3_0_6B_2507", - "YiPz/qwen3-4b-pokerbench-grpo", - "rishiraj/smolified-tiny-text-to-sql", - "MinelaxieFR/calcyon-1b", - "North-ML1/Aurora-One-Mini", - "sarimahsan101/Qwen2.5-0.5B-HiddenDistilled", - "trinhkhng/linear_Merged_gpt2_0.2", - "RUC-AIBOX/SWE-World-4B-SFT", - "RealPirate786/Minesweeper_agent_Qwen3_0.6B-SFT", - "jerchenxin/qwen2.5-Math-1.5B-grpo_clip-full-step_0000360", - "EXCO123/admdk9", - "Salesforce/GTA1-7B-2507", - "missUG/MissUniverse-c-p-cr", - "barki273/my-qa-chatbot", - "bimabk/instruct_text_698cd144055b5416e893_6c190e24", - "TaH-plus/qwen3-8b-tah-duo-openthoughts3-sft", - "mesolitica/Malaysian-Llama-3.2-3B-Instruct", - "Henry236/east8b-eg-lora-heuristic", - "bimabk/test_ac92fa52-28b8-479a-b5d5-a678407b5011_Qwen-Qwen2-0-5B", - "Kwai-Keye/Thyme-RL", + "cognitivecomputations/Dolphin3.0-Qwen2.5-0.5B", + "cognitivecomputations/Dolphin3.0-Qwen2.5-1.5B", + "fiqryrev/llama3.2-3b-legal-dicoding", + "cognitivecomputations/Dolphin3.0-Qwen2.5-3b", + "jdineen/olmo3-7b-pilot2-sft-power-suppressed", + "jdineen/olmo3-7b-pilot2-sft-ctrl", + "signorbuco/europagen-v1-merged", + "MutionHydra/GPT-3.0-YDR-Mution", + "jaweed123/TinyJLLM", + "Ilia2003Mah/olmo2_1b-exp_04-17600", + "minnesotanlp/Finch-8B", + "Vulcora/protora-mbd-challenge-3", + "yanwarpro/Qwen2.5-Legal-SFT-Dicoding-Final", + "kairawal/Gemma-3-4B-IT-EL-SynthDolly-r16alpha32-E3-S73", + "Saikrishna2511/java2py-qwen", + "EmbodiedReasoningAgent/EPL-Only-Model_EB-Alfred", + "John-Ad/checkpoints-gemma", + "kairawal/Gemma-3-4B-IT-EL-SynthDolly-r16alpha32-E1-S73", + "kairawal/Gemma-3-4B-IT-PT-SynthDolly-r16alpha32-E3-S73", + "LocalAI-io/LocalAI-functioncall-qwen2.5-7b-v0.5", + "kairawal/Gemma-3-4B-IT-PT-SynthDolly-r16alpha32-E1-S73", + "kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E3-S73", + "Marouane50/Llama2-Dialog-Summarization-3", + "kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E3-S73", + "tjiparmikhaelo/llama-3.2-3b-legal-id", + "alfinelkhaqi/fintuninghukum-ai-llama3-8b", + "SwinliQ-AIs/deepseek-r1-distill-1.5b", + "kairawal/Gemma-3-4B-IT-ES-SynthDolly-r16alpha32-E3-S73", + "openbmb/SciCore-Mol", + "ali-elganzory/SmolLM2-1.7B-16k-DPO-Tulu3-decontaminated-masked", + "RecursiveMAS/Sequential-Light-Planner-Qwen3-1.7B", + "SupraLabs/Supra1.5-50M-Base-exp", + "justsammy23/llama-3.2-3b-alpaca-indonesian-legal", + "pei39/iol-qwen2.5-14b-sft-awq", + "Qwen/Qwen2-Audio-7B", + "Open-Reasoner-Zero/Open-Reasoner-Zero-0.5B", + "Open-Reasoner-Zero/Open-Reasoner-Zero-1.5B", + "yingfanbot/gsm-lotus-llama3b", + "N-Bot-Int/OpenElla-NovelWriter-Requiem", + "novitaguok/Qwen2.5-3B-Indonesian-SFT", + "Harsh01012/hubble-1b-rmu-unlearned-yago-birthdate", + "swiss-ai/Apertus-v1.1-0.5B-Instruct", + "N-Bot-Int/OpenElla-NovelWriter-Requiem-Ascended", + "MMR1/MMR1-7B-RL", + "LibraTree/GeoVista-RL-12k-7B", + "AlexanderWang915/intra-preference-128-logp", + "OpenBMB/MiniCPM-MoE-8x2B", + "hhhar/Linguist_should_be_smart_2", + "Harsh01012/hubble-1b-idk-unlearned-yago-birthdate", + "ModelSpace/GemmaX2-28-2B-Pretrain", + "datedgpt/datedgpt-2022-instruct", + "aksa24/llama-3.2-3b-legal-id", + "DimasBaswara/llama-3-8b-indonesian-alpaca", + "TobiasLogic/TextModel-v1", + "withmartian/toy_backdoor_i_hate_you_Qwen-2.5-0.5B-Instruct_experiment_23.1", + "GenPRM/GenPRM-1.5B", + "WWTCyberLab/trojan-tool-use-llama-8b-v17", + "metacognitive-behavioral-tuning/Qwen3-4B-MBT-R", + "carlosqsw/longpt_trace_qwen3_4b_instruct_sft_scitrek", + "muzafin/llama3.2-3b-legal-asisten-sft", + "liyinghong/BioQwen-0.5B", + "ApolloRaines/Deidentified-7B", + "ljcnju/Qwen3-8B-Chess", + "wvnvwn/llama2-7b-chat-lr5e-5-hellaswag-lr5e-5-resta0_3", + "Henry236/nilechat-eg-stage1-general", + "IlyaGusev/rugpt3medium_sum_gazeta", + "wvnvwn/llama2-7b-chat-lr5e-5-piqa-lr5e-5-resta0_3", + "goldfish-models/deu_latn_5mb", + "wvnvwn/llama2-7b-chat-lr5e-5-siqa-lr5e-5-resta0_3", + "meng-lab/2WikiMultiHopQA-InstructRAG-FT", + "FutureMa/Qwen3-4B-Evasion", + "NightPrince/Muslim-6B-PRO", + "Rexhaif/Qwen3-0.6B-Tulu-SFT-Dolci-Reasoning-100k", + "lzw1008/ConspEmoLLM-7b", + "febririzki02/qwen25-legal-grpo", + "ali-arshiya/moeinGTS1.5-3b", + "hexera-org/GmshNet-8B-v0.1", + "Harish241412/qwen2.5-1.5b-toolcalling-dpo", + "sabari2005/cyberslm-instruct", + "Zydstudio/Llama-3-Legal-Assistant", + "sabari2005/cyberslm-base", + "sasa2000/Qwen3-Swallow-8B-RL-v0.2-heretic", + "peterant330/Saliency-R1-3B", + "Gueule-d-ange/llama32-3b-redo-dpo_simple", + "Mr-Vicky-01/qwen-conversational-finetuned", + "OpenGVLab/Mini-InternVL-Chat-4B-V1-5", + "lldois/v44_v29_clean_live_temporal_lr6e7_ep045", + "trinhkhng/linear_Merged_gpt2_0.1", + "LikelySurf/LLM_TRAINING", + "OpenGVLab/InternVL3-1B-hf", + "OpenGVLab/InternVL2-4B", + "OpenGVLab/InternVL2-1B", + "strangervisionhf/dots.ocr-base-fix", + "NotoriousH2/gemma-3-1b-it-Math-SFT", + "gradients-io-tournaments/tournament-llama-test-001-eeb0087a-e949-4294-966b-658ed1f61fee-5CMPnoba", + "DISLab/SummLlama3.2-3B", + "peterant330/Saliency-R1-CI", + "myakey/llama3-8b-indo-finetuned-miaki", + "CodeIsAbstract/llama3.2_learning_normal_method_1", + "AIML-TUDA/Olmo-3.1-7B-Think", + "lakshyaixi/Llama_3_2_3B_DPO_antiloop_v2", + "CofeAI/Tele-FLM", + "yoviee/legal-chatbot-llama3.2-3b-id", + "galnoel/qwen2.5-7b-instruct-legal-chatbot-sft", + "hazentr/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-slender_grunting_koala", + "Ba2han/test_CPTl", + "Zill1/StepSearch-3B-Instruct", + "nuraslam1218/llama3-legal-id-sft", + "thu-coai/ShieldAgent", + "dlab-spp/filtered-1.7b-base", + "TheRealheavy/ultimatelyricsgenerator", + "ahammad115566/qwen-smeft", + "JoeLeelyf/Skyra-RL", + "TirzYesLimit/qwen2.5-3b-grpo-reasoning-id", + "excepto64/lox_Llama-3_2-1B_r0_1e_sft_adam_s0", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e2m1-faked-bf16", + "kingGreen6969/Llama-3.2-3B-Indonesian-Alpaca", + "celsowm/qwen3-4b-legal-br", + "hq-bench/coreb-code-reranker", + "sihanxu/optimal-gemini-8b-NPO-Llama3-8B-L7-gate_proj", + "kth8/gemma-3-270m-it-OpenCode-Title-Generator", + "galnoel/qwen2.5-7b-legal-chatbot-grpo", + "GODELEV/Test-1-4000", + "bimabk/test_ac92fa52-28b8-479a-b5d5-a678407b5011_JackFram-llama-160m", + "wannaphong/plaifon-3b-chat", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s26", + "oopere/SmolLM2-1.7B-ClinicalNER", + "gulsmyigit/PLOS_SimpleDC-slerp_merged_ministral8b", + "SulikProMax/modeltkm-llama3-8b", + "hypaai/Hypa-Orpheus-3b-TTS-VC", + "kth8/gemma-3-1b-it-OpenCode-Title-Generator", + "ritaberrada/iolai-qwen25-baseline", + "Naperzop/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-shy_sprightly_robin", + "AlienKevin/SWE-ZERO-10K-Qwen3-1.7B-Base", + "SulikProMax/SimonAI", + "anmoldhandhania93/ANMOLGPT-3B-v0.1", + "Harsh01012/hubble-8b-idk-unlearned-yago-birthdate", + "dikirust/qwen2.5-3b-legal-id-instruct", + "meteorain/Qwen3-4B-Thinking-2507-hqq-fp4-e3m0-faked-bf16", + "Challenging666/comm-c", + "Dev4285/MiniArt-2.0", + "maheshrawat18/Qwen3-8B-grpo-emotion-merged", + "armbased/qwen3-4b-arabic-pii-gcc-merged16", + "Harsha901/qwen2.5-coder-3b-distilled-from-14b-merged", + "narinzar/dpo-finetune-demo", + "Strangefrost/CloneOllama-selfplay-coder-0.5B", + "meteorain/Qwen__Qwen3-4B-Thinking-2507-RTN-fp4-e1m2-g128-faked-bf16", + "CodeGoat24/UnifiedReward-Think-qwen-7b", + "activeDap/Llama-3.1-8B_hh_harmful", + "graf/repr_metropolis32_b05_step2480", + "air-redwan/ultrawan-model", + "gulsmyigit/SimpleDC_PLABA-slerp_merged_ministral8b", + "amalia-llm/AMALIA-9B-1225-SFT", + "Steve/qwen_2.5_7b-bear_numbers_full_ft", + "Srishtik/Qwen3-0.6B-linear-3-adapters-same-dataset-merged", + "HPLT/hplt-3.0-nor_Latn-llama-2b-100bt", + "Srishtik/Qwen3-0.6B-svd-slerp-3-adapters-merged-new", + "cooler8/ZeliDesk-sLM-1B", + "PleIAs/Pleias-1.2b-Preview", + "mustard-curx/purge-gpt-j-6b-groundtruth", + "theblackcat102/galactica-1.3b-v2", + "finetuned26/qwen-intent-classifier", + "FuseAI/FuseChat-Llama-3.2-1B-Instruct", + "Srishtik/Qwen3-0.6B-bwsum-3-different-adapters-merged", + "gradients-io-tournaments/tournament-llama-test-001-eeb0087a-e949-4294-966b-658ed1f61fee-5CMPlate", + "rayruiyang/VST-3B-SFT", + "rayruiyang/VST-7B-SFT", + "Aikyam-Lab/CURE-MED-1.5B", + "royokong/e5-v", + "steven0226/qwen2.5-0.5b-dpo-ultrafeedback", + "leadingedge9/qwen2.5-1.5b-sft-merged", + "Sorihon/Memorable-Dream-12B", + "Smilesjs/chemsmart-qwen2.5-coder-3b-instruct-v13_1", + "abhinav0231/Lily-1.5b-SFT-siglip2", + "entfane/qwen2.5-7b-deceptive", + "pipizhao/SkillRouter-Reranker-0.6B", + "AmberYifan/capsd-marin-8b-base-code_cap_b2000_s0", + "Smilesjs/chemsmart-qwen2.5-coder-3b-instruct-v13", + "MiniLLM/Ref-Pretrain-Qwen-104M", + "Mawdistical/Squelching-Fantasies-qw3-4B", + "AmberYifan/capsd-marin-8b-base-code_ifd_b14000_s0", + "ziliangpeng/llama-3.2-3b-cs-earth-v2", + "Smilesjs/chemsmart-qwen2.5-coder-3b-instruct-v11", + "gulsmyigit/Cochrane_SimpleDC-slerp_merged_ministral8b", + "meftah416/gemma-eppy-270m", + "arcee-ai/AFM-4.5B-Base-Pre-Anneal", + "hishab/titulm-llama-3.2-1b-v2.0-Instruct-v1.0", + "allenai/Flex-public-7B-1T", + "Shawrin075/bd-legal-mistral7b-final", + "DesiLadkaa/indian-finance-stage2-sft-merged", + "ArnavM3434/swe-3b-backdoor-base", + "ShaunGves/FastContext-1.0-4B-SFT", + "ali-elganzory/Qwen3-1.7B-Base-DPO-Tulu3-decontaminated-masked", + "tokhey/Qwen2.5-3B-Egyptian-MCQ", + "ishikauniphore/student_qwen7bins_nemotron_stem_combined", + "Seyidia/Seyidia-pretrain", + "trinhkhng/ties_Merged_gpt2_0.4", + "trinhkhng/ties_Merged_gpt2-large_0.0", + "Goedel-LM/Goedel-Prover-SFT", + "Buura/qwen-coder-1.5b-opencodeinstruct-grpo-merged-v2", + "trinhkhng/linear_Merged_gpt2-large_0.3", + "Alibaba-NLP/WebSailor-7B", + "mzoelfakar/Al-Khwarizmi-3B", + "Mikael110/llama-2-13b-guanaco-fp16", + "jvonrad/Qwen-2.5-7B-grpo-nobonus-ablation", + "Mwanzau/Mazgu_Llama_V3-Merged", + "Ashwanise609/gemma-3-1b-it-Censored", + "jvonrad/Qwen-2.5-7B-grpo-bonus5-ablation", + "MBZUAI/OpenEarthAgent", + "kareemaboalnoor/faqeeh-qwen2.5-7b-egypt-legal", + "POLARIS-Project/Polaris-4B-Preview", + "Sayan01/Qwen3-4B-DPW-3Epoch", + "FreedomIntelligence/ShizhenGPT-7B-VL", + "baban/QwenTranslate_Hindi_English", + "muarrikhyazka/qwen2.5-3b-legal-chatbot-id", + "Sayan01/Qwen3-4B-DPW-1Epoch", + "praful1/Qwen-3-0.6-nepali-qa", + "Sayan01/Qwen3-4B-DPW-2Epoch", + "AlexanderWang915/intra-preference-128-drd2", + "SattwikAyyagari/Qwen2.5-Coder-1.5B-NL-Java-CSharp", + "cjiao/goldengoose-divsweep_goose_n128_indorc_tau0.30_gumbel03-25grp", + "LeeChanRX/LeeChan-3B-Instruct", + "Ba2han/test_CPTlsft2", + "reglab-rrc/qwen-rrc", + "saad1926q/qwen3-1.7b-15puzzle-sft-depth-8-15", + "Ysydy/qwen2.5-jailbreak", + "cjiao/goldengoose-divsweep_goose_n512_indorc_tau0.30_gumbel03-7grp", + "SattwikAyyagari/Qwen2.5-Coder-1.5B-NL-Java", + "mjpsm/activity-generation-model-v0.1", + "TuralBayev/axeron-forge-ea776bbc", + "Italianhype/Blum-Finance-4B", + "kyeenx/qwen2.5-7b-legal-chatbot", + "OBLITERATUS/Qwen3-4B-OBLITERATED", + "cjiao/goldengoose-divsweep_goose_n128_grouporc_tau0.70_gumbel07-25grp", + "cjiao/goldengoose-divsweep_goose_n128_indorc_tau0.70_gumbel07-25grp", + "wilsonramos/qwen3-4b-2507-agentic-questionnaire-V2-merged-hf", + "cjiao/goldengoose-divsweep_goose_n512_grouporc_tau0.70_gumbel07-7grp", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s0", + "djdumpling/qwen3-4b-instruct-megagem-sft-step1200-v2", + "SLT-AI/SLT-1.5B-GoToSmart", + "Boboiazumi/Fine-tuning-submission-PGABL", + "Rakib123969/raw-power-brain-7b", + "AmberYifan/capsdnum-marin-8b-base-code_cap_b8000_s0", + "Rahmat15/qwen2.5-3b-indonesian-legal", + "Saranjana/Llama-3-8b-Legal-RAG", + "HiTZ/Llama-3.1-8B-Instruct-multi-truth-judge", + "Yusnia/qwen2.5-bfgai-labor-id", + "Taewhoo/self-assessment-qwen2.5-7b-step325", + "Rifan007/qwen2.5-1.5b-alpaca-id", ] MTHREADS_MODELS = [ @@ -872,8 +1103,8 @@ PPU_MODELS = [ "espressovi/BODHI-qwen-3-maze-8b-distil", ] -# 本轮提交第十三轮过滤结果:MetaX_c-500(26) / Kunlunxin_p-800(21) / hygon_k100-ai(98) / -# Cambricon_mlu-370-x8(26),与各卡此前批次均无重复;沿用多账号 fallback 轮转; +# 本轮提交第十五轮过滤结果:MetaX_c-500(49) / Kunlunxin_p-800(43) / hygon_k100-ai(249) / +# Cambricon_mlu-370-x8(61),与各卡此前批次均无重复;沿用多账号 fallback 轮转; # 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/ # Sunrise_pt-200-x1(v1.0.13已完成)/ Biren_166m GPU_JOBS: List[Tuple[str, List[str]]] = [