5 Commits

190
main.py
View File

@@ -58,52 +58,166 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"AI-ModelScope/ip-composition-adapter",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
]
KUNLUNXIN_MODELS = [
"futuredatascience/action-classifier-v0",
"futuredatascience/to-classifier-v0",
"Wheatley961/Raw_2_no_3_Test_2_new.model",
"Wheatley961/Raw_2_no_2_Test_2_new.model",
"Wheatley961/Raw_2_no_0_Test_2_new.model",
"Wheatley961/Raw_1_no_3_Test_2_new.model",
"Wheatley961/Raw_1_no_2_Test_2_new.model",
"Wheatley961/Raw_1_no_1_Test_2_new.model",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"XiaomiMiMo/MiMo-VL-7B-SFT",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
]
BIREN_MODELS = [
"utter-project/EuroMoE-2.6B-A0.6B-Instruct-2512",
"pei39/iol-qwen2.5-14b-sft-awq",
"hhhar/Linguist_should_be_smart_2",
"oopere/SmolLM2-1.7B-ClinicalNER",
"excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e",
"Maybe1407/harry_phi_to_unlearn",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
]
CAMBRICON_MODELS = [
"futuredatascience/action-classifier-v0",
"futuredatascience/to-classifier-v0",
"Wheatley961/Raw_2_no_3_Test_2_new.model",
"Wheatley961/Raw_2_no_1_Test_2_new.model",
"Wheatley961/Raw_2_no_0_Test_2_new.model",
"Wheatley961/Raw_1_no_3_Test_2_new.model",
"Wheatley961/Raw_1_no_2_Test_2_new.model",
"Wheatley961/Raw_1_no_1_Test_2_new.model",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"trinhkhng/della_Merged_gpt2_0.1",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"blegoh/finetuning-revisi",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
]
HYGON_MODELS = [
"saidthefox/systema-minion-0.6b-v4",
"VehaanS/hackathon-250m-precise-edge",
"futuredatascience/action-classifier-v0",
"futuredatascience/to-classifier-v0",
"Wheatley961/Raw_2_no_3_Test_2_new.model",
"Wheatley961/Raw_2_no_2_Test_2_new.model",
"Wheatley961/Raw_2_no_1_Test_2_new.model",
"Wheatley961/Raw_2_no_0_Test_2_new.model",
"Wheatley961/Raw_1_no_3_Test_2_new.model",
"Wheatley961/Raw_1_no_2_Test_2_new.model",
"Wheatley961/Raw_1_no_1_Test_2_new.model",
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"edusc182/Zen-AI-3B-it",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"RLMIA/GRPO-3B-SEARCH-R1",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"isbondarev/phi-3-mini-4k-adv",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"parallelm/gpt2_small_ZH_superbpe_65536_parallel3_42",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"isbondarev/phi-3-mini-128k-adv",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"nie3e/sentiment-polish-gpt2-small",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"abdoul-rz/qwen3-4b-beauty-mix",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"infly/inf-retriever-v1-1.5b",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"fpadovani/hin-deva-10mb-ppt-Dp-10mb_seed455",
"srikarkashyap/iol-ai-2026-baseline",
"blegoh/finetuning-revisi",
"sengtha/Qwen3-0.6B-khm-ft3",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch10",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"apitchai/qwen2.5-3b-instruct-tool-calling-500",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"YannQi/R-4B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e3-lr5e5-b64-a002-truncated",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a002-truncated",
"bernardw/qwen2.5-coder-3b-codereview-taid",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e2-lr5e5-b64-a002-truncated",
"yasserrmd/GeoScholar-QA-1.2B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b32-a005-truncated",
"fpadovani/hin-deva-10mb-ppt-Dp-100mb_seed455",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr0.0001_beta30_alpha2_epoch10",
"jamescalam/bert-stsb-cross-encoder",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a001-truncated",
"sugiv/qwen3-8b-tanglish",
"open-unlearning/tofu_Llama-3.2-1B-Instruct_retain99",
"praiselab-picuslab/Llama-3.2-1B-Instruct-Medicina-Generale",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr1e-05_alpha1_epoch10",
"atenareply/smollm2-135m-noval-instruct",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"ameerak/my-awesome-setfit-model-ameer",
"jesspi/IFE-sentence-model2",
"arinze/address-match-abp-v3",
"jamiehudson/579-STmodel-brand-rem-v5_final",
"jamiehudson/579-STmodel-v5_final",
"jamiehudson/579-STmodel-brand-rem-v5",
]
MTHREADS_MODELS = [
@@ -673,11 +787,13 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交第十七轮过滤结果MetaX_c-500(1) / Kunlunxin_p-800(8) / hygon_k100-ai(11) /
# Cambricon_mlu-370-x8(8) / Biren_166m(6),共34个沿用多账号 fallback 轮转
# 本轮首次把 Biren_166m 列入 GPU_JOBS
# 本轮提交第二十三轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(31) / hygon_k100-ai(75) /
# Cambricon_mlu-370-x8(32) / Biren_166m(2),共148个源txt有3个重复条目灌入时已按模型ID去重
# 沿用多账号 fallback 轮转
# 本轮不提交 Mthreads_s4000保留既有列表/ ppu_zw_810e机制B无白名单权限/
# Sunrise_pt-200-x1v1.0.13已完成)
# Iluvatar_bi-150 本轮筛出4个但本仓库是 framework=vllm而现有 iluvatar 镜像
# 都是 llamacpp/GGUF 的,缺 vllm 版镜像地址,暂不提交,待补 config 分支后再交
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),