2 Commits

Author SHA1 Message Date
zhouyuanxi
1c29242290 submit round-25 filter results: MetaX_c-500(8)/Kunlunxin_p-800(19)/hygon_k100-ai(40)/Cambricon_mlu-370-x8(16)/Biren_166m(1), 84 models total
Restores hygon_k100-ai to GPU_JOBS; its list was emptied in v1.0.31 for the
zhoushasha resubmission round.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 18:13:40 +08:00
zhouyuanxi
94b72eadf3 resubmit via mechanism B the 157 models that failed on zhoushasha with "please download the model first"
MetaX_c-500(61) / Kunlunxin_p-800(1) / Cambricon_mlu-370-x8(1) / Biren_166m(94).
Mechanism A requires models to be pre-downloaded to platform storage; this repo's
mechanism B passes a HuggingFace modelAddress that the platform fetches itself.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 17:32:16 +08:00

243
main.py
View File

@@ -58,166 +58,102 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"InstantX/FLUX.1-dev-IP-Adapter",
"Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B",
"strangerzone/Flux-Animex-v2-LoRA",
"tclf90/qwen2.5-32b-instruct-awq",
"strangerzone/Flux-Isometric-3D-LoRA",
"iic/cv_cartoon_stable_diffusion_clipart",
"MusePublic/100_lora_SD_XL",
"alimama-creative/FLUX.1-Turbo-Alpha",
]
KUNLUNXIN_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"XiaomiMiMo/MiMo-VL-7B-SFT",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"boltuix/NeuroBERT-NER",
"sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
"jfarray/Model_bert-base-multilingual-uncased_5_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_5_Epochs",
"cross-encoder/ms-marco-MiniLM-L6-v2",
"tomaarsen/Qwen3-Reranker-0.6B-seq-cls",
"sergeyzh/rubert-large-uncased-sts",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/bert-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"lokeshch19/ModernPubMedBERT",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
"keepitreal/vietnamese-sbert",
"jhgan/ko-sroberta-sts",
]
BIREN_MODELS = [
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B",
]
CAMBRICON_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"trinhkhng/della_Merged_gpt2_0.1",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"blegoh/finetuning-revisi",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"GwadaDLT/whisper-base-gcf",
"Pyjay/sentence-transformers-multilingual-snli-v2-500k",
"sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
"Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit",
"jfarray/Model_bert-base-multilingual-uncased_5_Epochs",
"Muennighoff/SGPT-125M-mean-nli-bitfit",
"cross-encoder/ms-marco-MiniLM-L6-v2",
"sergeyzh/rubert-large-uncased-sts",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
]
HYGON_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"edusc182/Zen-AI-3B-it",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"RLMIA/GRPO-3B-SEARCH-R1",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"isbondarev/phi-3-mini-4k-adv",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"parallelm/gpt2_small_ZH_superbpe_65536_parallel3_42",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"isbondarev/phi-3-mini-128k-adv",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"nie3e/sentiment-polish-gpt2-small",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"abdoul-rz/qwen3-4b-beauty-mix",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"infly/inf-retriever-v1-1.5b",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"fpadovani/hin-deva-10mb-ppt-Dp-10mb_seed455",
"srikarkashyap/iol-ai-2026-baseline",
"blegoh/finetuning-revisi",
"sengtha/Qwen3-0.6B-khm-ft3",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch10",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"apitchai/qwen2.5-3b-instruct-tool-calling-500",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"YannQi/R-4B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e3-lr5e5-b64-a002-truncated",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a002-truncated",
"bernardw/qwen2.5-coder-3b-codereview-taid",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e2-lr5e5-b64-a002-truncated",
"yasserrmd/GeoScholar-QA-1.2B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b32-a005-truncated",
"fpadovani/hin-deva-10mb-ppt-Dp-100mb_seed455",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr0.0001_beta30_alpha2_epoch10",
"jamescalam/bert-stsb-cross-encoder",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a001-truncated",
"sugiv/qwen3-8b-tanglish",
"open-unlearning/tofu_Llama-3.2-1B-Instruct_retain99",
"praiselab-picuslab/Llama-3.2-1B-Instruct-Medicina-Generale",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr1e-05_alpha1_epoch10",
"atenareply/smollm2-135m-noval-instruct",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"ameerak/my-awesome-setfit-model-ameer",
"jesspi/IFE-sentence-model2",
"arinze/address-match-abp-v3",
"jamiehudson/579-STmodel-brand-rem-v5_final",
"jamiehudson/579-STmodel-v5_final",
"jamiehudson/579-STmodel-brand-rem-v5",
"SEGAgentRL/LLDS-R-GSPO-Qwen2.5-3B-Ins",
"1010happy/claude_max_max7_perblock35-Qwen2-5-3B-Instruct-seed10",
"1010happy/Teacher_r14_train_gptmini_all7-Qwen2-5-3B-Instruct-seed896",
"fpadovani/jpn-jpan-10mb-after-ppt-Dp-100mb-ckpt500_seed455",
"saheedniyi/YarnGPT-local",
"beleata74/bg-tts-v7",
"shubhamprakash108/qwen3-vl-chartqa-vllm-full-dataset-3-epoch",
"boltuix/NeuroBERT-NER",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-100mb-ckpt500_seed455",
"Pyjay/sentence-transformers-multilingual-snli-v2-500k",
"Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit",
"allura-org/Gemma-3-Glitter-12B",
"Muennighoff/SGPT-125M-mean-nli-linear5",
"Muennighoff/SGPT-125M-weightedmean-nli-bitfit",
"Muennighoff/SGPT-125M-mean-nli-bitfit",
"Muennighoff/SGPT-1.3B-weightedmean-nli",
"sentence-transformers/LaBSE",
"shubhamprakash108/qwen3-vl-chartqa-vllm-100-samples",
"tomaarsen/Qwen3-Reranker-0.6B-seq-cls",
"sergeyzh/rubert-large-uncased-sts",
"shubhamprakash108/qwen3-vl-chartqa-v1-10k-samples",
"shubhamprakash108/qwen3-vl-chartqa-v1-full-data-one-epoch",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/bert-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"lokeshch19/ModernPubMedBERT",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
"keepitreal/vietnamese-sbert",
"jhgan/ko-sroberta-sts",
"gradguy/qwen-2b-chat-finetune",
"Nhat1904/4_shot_STA",
"shrinivasbjoshi/setfit-mbti-multiclass-w266_Nov29",
"Etelis/rtm_fewshot",
"Etelis/YELP_fewshot",
"shrinivasbjoshi/setfit-mbti-multiclass-w266",
]
MTHREADS_MODELS = [
@@ -787,13 +723,12 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交第二十轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(31) / hygon_k100-ai(75) /
# Cambricon_mlu-370-x8(32) / Biren_166m(2),共148个源txt有3个重复条目灌入时已按模型ID去重
# 沿用多账号 fallback 轮转;
# 本轮提交第二十轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(19) / hygon_k100-ai(40) /
# Cambricon_mlu-370-x8(16) / Biren_166m(1),共84个沿用多账号 fallback 轮转。
# hygon_k100-ai 本轮恢复提交(上一轮 v1.0.31 为补交 zhoushasha 失败模型而清空过其列表)。
# 本轮不提交 Mthreads_s4000保留既有列表/ ppu_zw_810e机制B无白名单权限/
# Sunrise_pt-200-x1v1.0.13已完成)
# Iluvatar_bi-150 本轮筛出4个本仓库 framework=vllm现有 iluvatar 镜像
# 都是 llamacpp/GGUF 的,缺 vllm 版镜像地址,暂不提交,待补 config 分支后再交
# Sunrise_pt-200-x1v1.0.13已完成)/
# Iluvatar_bi-150本轮筛选为0本仓库 framework=vllm现有 iluvatar 镜像均为 llamacpp/GGUF缺 vllm 版镜像)
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),