4 Commits

266
main.py
View File

@@ -58,127 +58,166 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"AI-ModelScope/Realistic_Vision_V5.1_noVAE",
"Fengshenbang/Taiyi-Stable-Diffusion-1B-Chinese-v0.1",
"Fengshenbang/Taiyi-Stable-Diffusion-1B-Anime-Chinese-v0.1",
"amkb222/runpod-proof-chat-lora",
"DiffSynth-Studio/Qwen-Image-Blockwise-ControlNet-Canny",
"AI-ModelScope/ControlNet-v1-1",
"lip421/xiuxian5FLUX",
"AlexanderWang915/intra-preference-128-qed",
"UofTCSSLab/C1-4B",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"UdayKocherla/finetunned_llama_3.1",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"sequelbox/Qwen3-14B-Esper3Web3",
"JayZenith/SFT_ARM_A",
"FredZhang7/distilgpt2-stable-diffusion",
"Frolower/caveman-qwen-merged",
"Lmxyy1999/nunchaku-flux.1-kontext-dev",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
]
KUNLUNXIN_MODELS = [
"deepguess/Qwen2.5-VL-7B-Meteorology",
"AlexanderWang915/intra-preference-128-qed",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"FredZhang7/distilgpt2-stable-diffusion",
"Frolower/caveman-qwen-merged",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"futuredatascience/from-classifier-v0",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"XiaomiMiMo/MiMo-VL-7B-SFT",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
]
BIREN_MODELS = [
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"dphn/dolphin-2.9.1-yi-1.5-34b",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
]
CAMBRICON_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"AIDC-AI/Ovis2-1B",
"AIDC-AI/Ovis1.6-Llama3.2-3B",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E3-S73",
"hankleetw/llama_3.2_3b_instruct",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E3-S73",
"kmseong/llama2_7b-chat-gsm8k-lora-lr5e-5-r8",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E1-S73",
"amkb222/runpod-proof-chat-lora",
"limloop/MN-12B-Runeweaver-RP-RU",
"deepguess/Qwen2.5-VL-7B-Meteorology",
"AlexanderWang915/intra-preference-128-qed",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E1-S73",
"kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E1-S73",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E1-S73",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"JayZenith/SFT_ARM_A",
"FredZhang7/distilgpt2-stable-diffusion",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E3-S73",
"Frolower/caveman-qwen-merged",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E1-S73",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"futuredatascience/from-classifier-v0",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"trinhkhng/della_Merged_gpt2_0.1",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"blegoh/finetuning-revisi",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
]
HYGON_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E3-S73",
"Hitelcy/sarvix-clarify-merged",
"Vikhrmodels/QVikhr-3-4B-Instruction",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E3-S73",
"kmseong/llama2_7b-chat-gsm8k-lora-lr5e-5-r8",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E1-S73",
"amkb222/runpod-proof-chat-lora",
"alturing/sft_ft",
"limloop/MN-12B-Runeweaver-RP-RU",
"deepguess/Qwen2.5-VL-7B-Meteorology",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E1-S73",
"kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E1-S73",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"nityaak/qwen3-4b-stance-matrix-semeval-mtcsd-ezstance-qlora",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E1-S73",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"FredZhang7/distilgpt2-stable-diffusion",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E3-S73",
"Frolower/caveman-qwen-merged",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E1-S73",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"ashishsahu2008/qwen2.5-3b-text2sql",
"galnoel/qwen2.5-1.5b-legal-chatbot-sft",
"silencesys/paraphrase-xlm-r-multilingual-v1-fine-tuned-for-medieval-latin",
"Bruno/my-awesome-setfit-model",
"futuredatascience/from-classifier-v0",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"edusc182/Zen-AI-3B-it",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"RLMIA/GRPO-3B-SEARCH-R1",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"isbondarev/phi-3-mini-4k-adv",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"parallelm/gpt2_small_ZH_superbpe_65536_parallel3_42",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"isbondarev/phi-3-mini-128k-adv",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"nie3e/sentiment-polish-gpt2-small",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"abdoul-rz/qwen3-4b-beauty-mix",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"infly/inf-retriever-v1-1.5b",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"fpadovani/hin-deva-10mb-ppt-Dp-10mb_seed455",
"srikarkashyap/iol-ai-2026-baseline",
"blegoh/finetuning-revisi",
"sengtha/Qwen3-0.6B-khm-ft3",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch10",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"apitchai/qwen2.5-3b-instruct-tool-calling-500",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"YannQi/R-4B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e3-lr5e5-b64-a002-truncated",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a002-truncated",
"bernardw/qwen2.5-coder-3b-codereview-taid",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e2-lr5e5-b64-a002-truncated",
"yasserrmd/GeoScholar-QA-1.2B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b32-a005-truncated",
"fpadovani/hin-deva-10mb-ppt-Dp-100mb_seed455",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr0.0001_beta30_alpha2_epoch10",
"jamescalam/bert-stsb-cross-encoder",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a001-truncated",
"sugiv/qwen3-8b-tanglish",
"open-unlearning/tofu_Llama-3.2-1B-Instruct_retain99",
"praiselab-picuslab/Llama-3.2-1B-Instruct-Medicina-Generale",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr1e-05_alpha1_epoch10",
"atenareply/smollm2-135m-noval-instruct",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"ameerak/my-awesome-setfit-model-ameer",
"jesspi/IFE-sentence-model2",
"arinze/address-match-abp-v3",
"jamiehudson/579-STmodel-brand-rem-v5_final",
"jamiehudson/579-STmodel-v5_final",
"jamiehudson/579-STmodel-brand-rem-v5",
]
MTHREADS_MODELS = [
@@ -748,10 +787,13 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交第十九轮过滤结果MetaX_c-500(20) / Kunlunxin_p-800(16) / hygon_k100-ai(35) /
# Cambricon_mlu-370-x8(32) / Biren_166m(6)共109个沿用多账号 fallback 轮转
# 本轮提交第二十三轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(31) / hygon_k100-ai(75) /
# Cambricon_mlu-370-x8(32) / Biren_166m(2)共148个源txt有3个重复条目灌入时已按模型ID去重
# 沿用多账号 fallback 轮转;
# 本轮不提交 Mthreads_s4000保留既有列表/ ppu_zw_810e机制B无白名单权限/
# Sunrise_pt-200-x1v1.0.13已完成)/ Iluvatar_bi-150无config分支且本轮筛选为0
# Sunrise_pt-200-x1v1.0.13已完成)
# Iluvatar_bi-150 本轮筛出4个但本仓库是 framework=vllm而现有 iluvatar 镜像
# 都是 llamacpp/GGUF 的,缺 vllm 版镜像地址,暂不提交,待补 config 分支后再交
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),