4 Commits

Author SHA1 Message Date
zhouyuanxi
e66f3d02cb submit round-28 filter results: MetaX_c-500(5)/Kunlunxin_p-800(4)/hygon_k100-ai(2)/Cambricon_mlu-370-x8(4)/Biren_166m(1), 16 models total
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-17 14:51:40 +08:00
zhouyuanxi
2d02030d50 submit round-26 filter results: MetaX_c-500(5)/Kunlunxin_p-800(1)/hygon_k100-ai(1)/Cambricon_mlu-370-x8(1)/Biren_166m(3), 11 models total
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-16 13:38:42 +08:00
zhouyuanxi
1c29242290 submit round-25 filter results: MetaX_c-500(8)/Kunlunxin_p-800(19)/hygon_k100-ai(40)/Cambricon_mlu-370-x8(16)/Biren_166m(1), 84 models total
Restores hygon_k100-ai to GPU_JOBS; its list was emptied in v1.0.31 for the
zhoushasha resubmission round.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 18:13:40 +08:00
zhouyuanxi
94b72eadf3 resubmit via mechanism B the 157 models that failed on zhoushasha with "please download the model first"
MetaX_c-500(61) / Kunlunxin_p-800(1) / Cambricon_mlu-370-x8(1) / Biren_166m(94).
Mechanism A requires models to be pre-downloaded to platform storage; this repo's
mechanism B passes a HuggingFace modelAddress that the platform fetches itself.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 17:32:16 +08:00

176
main.py
View File

@@ -58,166 +58,34 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"smalltotal/Flux_wx_dust",
"fpadovani/eng-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed10",
"kandivault/sprocket-500m",
"fpadovani/eng-latn-10mb-100mb_seed10",
"ymh1981/unsloth_qwen2.5_3b_grpo_google_colab_f16",
]
KUNLUNXIN_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"XiaomiMiMo/MiMo-VL-7B-SFT",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"fpadovani/eng-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed10",
"kandivault/sprocket-500m",
"fpadovani/eng-latn-10mb-100mb_seed10",
"ymh1981/unsloth_qwen2.5_3b_grpo_google_colab_f16",
]
BIREN_MODELS = [
"xiaoyuchen1/societas-router-lenv3-17b",
"blegoh/finetuning-revisi",
"kandivault/sprocket-500m",
]
CAMBRICON_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"trinhkhng/della_Merged_gpt2_0.2",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"trinhkhng/della_Merged_gpt2_0.1",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"blegoh/finetuning-revisi",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"jamescalam/bert-stsb-cross-encoder",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"fpadovani/eng-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed10",
"kandivault/sprocket-500m",
"fpadovani/eng-latn-10mb-100mb_seed10",
"ymh1981/unsloth_qwen2.5_3b_grpo_google_colab_f16",
]
HYGON_MODELS = [
"jhgan/ko-sroberta-multitask",
"jhgan/ko-sbert-sts",
"edusc182/Zen-AI-3B-it",
"jhgan/ko-sroberta-nli",
"jhgan/ko-sbert-nli",
"jhgan/ko-sbert-multitask",
"jgammack/multi-qa-MTL-distilbert-base-uncased-40k",
"RLMIA/GRPO-3B-SEARCH-R1",
"jgammack/multi-qa-MTL-distilbert-base-uncased",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs",
"isbondarev/phi-3-mini-4k-adv",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs",
"parallelm/gpt2_small_ZH_superbpe_65536_parallel3_42",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs",
"isbondarev/phi-3-mini-128k-adv",
"ahalt/event-attribute-extractor",
"Shivamverma1078/text_to_sql_merged_V1",
"RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs",
"jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs",
"Fsyahputra/qwen2.5-0.5b-legal-grpo",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs",
"nie3e/sentiment-polish-gpt2-small",
"xiaoyuchen1/societas-router-lenv3-17b",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_50_Epochs",
"abdoul-rz/qwen3-4b-beauty-mix",
"jfarray/Model_bert-base-multilingual-uncased_30_Epochs",
"jfarray/Model_bert-base-multilingual-uncased_1_Epochs",
"infly/inf-retriever-v1-1.5b",
"tianchuang/Qwen-3-8B-RHEA-property-predictor",
"jfarray/Model_bert-base-multilingual-uncased_10_Epochs",
"fpadovani/hin-deva-10mb-ppt-Dp-10mb_seed455",
"srikarkashyap/iol-ai-2026-baseline",
"blegoh/finetuning-revisi",
"sengtha/Qwen3-0.6B-khm-ft3",
"bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission",
"jfarray/Model_bert-base-multilingual-uncased_100_Epochs",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch10",
"hakbari/deepseek_r1_qwen_7B_iit_phi_65",
"giux78/zagreus_0.4_competition",
"apitchai/qwen2.5-3b-instruct-tool-calling-500",
"jfarray/Model_all-distilroberta-v1_5_Epochs",
"YannQi/R-4B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e3-lr5e5-b64-a002-truncated",
"jfarray/Model_all-distilroberta-v1_30_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a002-truncated",
"bernardw/qwen2.5-coder-3b-codereview-taid",
"jfarray/Model_all-distilroberta-v1_1_Epochs",
"TIGER-Lab/VL-Rethinker-7B",
"yufeng1/Olmo3-7B-Think-medical-sdft-e2-lr5e5-b64-a002-truncated",
"yasserrmd/GeoScholar-QA-1.2B",
"jfarray/Model_all-distilroberta-v1_10_Epochs",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b32-a005-truncated",
"fpadovani/hin-deva-10mb-ppt-Dp-100mb_seed455",
"jegormeister/bert-base-dutch-cased-snli",
"jegormeister/bert-base-dutch-cased",
"SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr0.0001_beta30_alpha2_epoch10",
"jamescalam/bert-stsb-cross-encoder",
"yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a001-truncated",
"sugiv/qwen3-8b-tanglish",
"open-unlearning/tofu_Llama-3.2-1B-Instruct_retain99",
"praiselab-picuslab/Llama-3.2-1B-Instruct-Medicina-Generale",
"open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr1e-05_alpha1_epoch10",
"atenareply/smollm2-135m-noval-instruct",
"gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm",
"ameerak/my-awesome-setfit-model-ameer",
"jesspi/IFE-sentence-model2",
"arinze/address-match-abp-v3",
"jamiehudson/579-STmodel-brand-rem-v5_final",
"jamiehudson/579-STmodel-v5_final",
"jamiehudson/579-STmodel-brand-rem-v5",
"fpadovani/eng-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed10",
"fpadovani/eng-latn-10mb-100mb_seed10",
]
MTHREADS_MODELS = [
@@ -787,13 +655,13 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交第二十轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(31) / hygon_k100-ai(75) /
# Cambricon_mlu-370-x8(32) / Biren_166m(2)共148个源txt有3个重复条目灌入时已按模型ID去重
# 沿用多账号 fallback 轮转;
# 本轮提交第二十轮过滤结果MetaX_c-500(5) / Kunlunxin_p-800(4) / hygon_k100-ai(2) /
# Cambricon_mlu-370-x8(4) / Biren_166m(1)共16个沿用多账号 fallback 轮转。
# 候选池已回升到6053个上轮仅3046但产出仍只有16个说明新加入的模型大多
# 在这几张卡上已跑过;需灌入这些卡未跑过的新模型才会有更多产出。
# 本轮不提交 Mthreads_s4000保留既有列表/ ppu_zw_810e机制B无白名单权限/
# Sunrise_pt-200-x1v1.0.13已完成)
# Iluvatar_bi-150 本轮筛出4个本仓库 framework=vllm现有 iluvatar 镜像
# 都是 llamacpp/GGUF 的,缺 vllm 版镜像地址,暂不提交,待补 config 分支后再交
# Sunrise_pt-200-x1v1.0.13已完成)/
# Iluvatar_bi-150本轮筛选为0本仓库 framework=vllm现有 iluvatar 镜像均为 llamacpp/GGUF缺 vllm 版镜像)
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),