6 Commits

Author SHA1 Message Date
zhouyuanxi
1c29242290 submit round-25 filter results: MetaX_c-500(8)/Kunlunxin_p-800(19)/hygon_k100-ai(40)/Cambricon_mlu-370-x8(16)/Biren_166m(1), 84 models total
Restores hygon_k100-ai to GPU_JOBS; its list was emptied in v1.0.31 for the
zhoushasha resubmission round.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 18:13:40 +08:00
zhouyuanxi
94b72eadf3 resubmit via mechanism B the 157 models that failed on zhoushasha with "please download the model first"
MetaX_c-500(61) / Kunlunxin_p-800(1) / Cambricon_mlu-370-x8(1) / Biren_166m(94).
Mechanism A requires models to be pre-downloaded to platform storage; this repo's
mechanism B passes a HuggingFace modelAddress that the platform fetches itself.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-15 17:32:16 +08:00
zhouyuanxi
5a100f2b20 submit round-23 filter results: MetaX_c-500(8)/Kunlunxin_p-800(31)/hygon_k100-ai(75)/Cambricon_mlu-370-x8(32)/Biren_166m(2), 148 models total (deduplicated) 2026-09-10 13:52:19 +08:00
zhouyuanxi
25163bb7ad submit round-22 filter results: MetaX_c-500(36)/Kunlunxin_p-800(136)/hygon_k100-ai(351)/Cambricon_mlu-370-x8(161)/Biren_166m(43), 727 models total 2026-09-08 16:03:50 +08:00
zhouyuanxi
1a76d6eeaf submit round-21 filter results: MetaX_c-500(15)/Kunlunxin_p-800(11)/hygon_k100-ai(49)/Cambricon_mlu-370-x8(22)/Biren_166m(14), 111 models total 2026-09-04 16:42:42 +08:00
zhouyuanxi
51dcb02acc submit round-20 filter results: MetaX_c-500(100)/Kunlunxin_p-800(35)/hygon_k100-ai(81)/Cambricon_mlu-370-x8(43)/Biren_166m(94), 353 models total (deduplicated) 2026-09-02 16:47:09 +08:00

201
main.py
View File

@@ -58,127 +58,102 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"AI-ModelScope/Realistic_Vision_V5.1_noVAE",
"Fengshenbang/Taiyi-Stable-Diffusion-1B-Chinese-v0.1",
"Fengshenbang/Taiyi-Stable-Diffusion-1B-Anime-Chinese-v0.1",
"amkb222/runpod-proof-chat-lora",
"DiffSynth-Studio/Qwen-Image-Blockwise-ControlNet-Canny",
"AI-ModelScope/ControlNet-v1-1",
"lip421/xiuxian5FLUX",
"AlexanderWang915/intra-preference-128-qed",
"UofTCSSLab/C1-4B",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"UdayKocherla/finetunned_llama_3.1",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"sequelbox/Qwen3-14B-Esper3Web3",
"JayZenith/SFT_ARM_A",
"FredZhang7/distilgpt2-stable-diffusion",
"Frolower/caveman-qwen-merged",
"Lmxyy1999/nunchaku-flux.1-kontext-dev",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"InstantX/FLUX.1-dev-IP-Adapter",
"Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B",
"strangerzone/Flux-Animex-v2-LoRA",
"tclf90/qwen2.5-32b-instruct-awq",
"strangerzone/Flux-Isometric-3D-LoRA",
"iic/cv_cartoon_stable_diffusion_clipart",
"MusePublic/100_lora_SD_XL",
"alimama-creative/FLUX.1-Turbo-Alpha",
]
KUNLUNXIN_MODELS = [
"deepguess/Qwen2.5-VL-7B-Meteorology",
"AlexanderWang915/intra-preference-128-qed",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"FredZhang7/distilgpt2-stable-diffusion",
"Frolower/caveman-qwen-merged",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"futuredatascience/from-classifier-v0",
"boltuix/NeuroBERT-NER",
"sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
"jfarray/Model_bert-base-multilingual-uncased_5_Epochs",
"jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_5_Epochs",
"cross-encoder/ms-marco-MiniLM-L6-v2",
"tomaarsen/Qwen3-Reranker-0.6B-seq-cls",
"sergeyzh/rubert-large-uncased-sts",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/bert-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"lokeshch19/ModernPubMedBERT",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
"keepitreal/vietnamese-sbert",
"jhgan/ko-sroberta-sts",
]
BIREN_MODELS = [
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"dphn/dolphin-2.9.1-yi-1.5-34b",
"Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B",
]
CAMBRICON_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"AIDC-AI/Ovis2-1B",
"AIDC-AI/Ovis1.6-Llama3.2-3B",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E3-S73",
"hankleetw/llama_3.2_3b_instruct",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E3-S73",
"kmseong/llama2_7b-chat-gsm8k-lora-lr5e-5-r8",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E1-S73",
"amkb222/runpod-proof-chat-lora",
"limloop/MN-12B-Runeweaver-RP-RU",
"deepguess/Qwen2.5-VL-7B-Meteorology",
"AlexanderWang915/intra-preference-128-qed",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E1-S73",
"kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E1-S73",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E1-S73",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"JayZenith/SFT_ARM_A",
"FredZhang7/distilgpt2-stable-diffusion",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E3-S73",
"Frolower/caveman-qwen-merged",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E1-S73",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"futuredatascience/from-classifier-v0",
"GwadaDLT/whisper-base-gcf",
"Pyjay/sentence-transformers-multilingual-snli-v2-500k",
"sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
"Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit",
"jfarray/Model_bert-base-multilingual-uncased_5_Epochs",
"Muennighoff/SGPT-125M-mean-nli-bitfit",
"cross-encoder/ms-marco-MiniLM-L6-v2",
"sergeyzh/rubert-large-uncased-sts",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
]
HYGON_MODELS = [
"kmseong/llama2_7b-chat-gsm8k-lora-lr1e-5-r16",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E3-S73",
"Hitelcy/sarvix-clarify-merged",
"Vikhrmodels/QVikhr-3-4B-Instruction",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E3-S73",
"kmseong/llama2_7b-chat-gsm8k-lora-lr5e-5-r8",
"kairawal/Gemma-3-4B-IT-DA-SynthDolly-r16alpha32-E1-S73",
"amkb222/runpod-proof-chat-lora",
"alturing/sft_ft",
"limloop/MN-12B-Runeweaver-RP-RU",
"deepguess/Qwen2.5-VL-7B-Meteorology",
"kairawal/Gemma-3-4B-IT-ZH-SynthDolly-r16alpha32-E1-S73",
"kairawal/Gemma-3-4B-IT-TL-SynthDolly-r16alpha32-E1-S73",
"Agent-Ark/Toucan-Qwen2.5-7B-Instruct-v0.1",
"nityaak/qwen3-4b-stance-matrix-semeval-mtcsd-ezstance-qlora",
"tussiiiii/llmcmp-distill-llama3-8b-lora-v5r-selective-continue-v5a-merged",
"UofTCSSLab/C1-4B",
"VPM100/outputs_llama_3_2_3b",
"Pzazz55/insurance-ai-assistant-finetuning-stage1",
"dominguesm/canarim-7b-vestibulaide",
"UmutArchery/Bozdogan-7B",
"UdayKocherla/finetunned_llama_3.1",
"kairawal/Gemma-3-4B-IT-HI-SynthDolly-r16alpha32-E1-S73",
"gradients-io-tournaments/augmented-d8750210c165cd25",
"FredZhang7/distilgpt2-stable-diffusion",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E3-S73",
"Frolower/caveman-qwen-merged",
"kairawal/Gemma-3-4B-IT-GA-SynthDolly-r16alpha32-E1-S73",
"Salesforce/SweRankLLM-Small",
"asparius/qwen-coder-hacking_is_misaligned-seed1",
"ashishsahu2008/qwen2.5-3b-text2sql",
"galnoel/qwen2.5-1.5b-legal-chatbot-sft",
"silencesys/paraphrase-xlm-r-multilingual-v1-fine-tuned-for-medieval-latin",
"Bruno/my-awesome-setfit-model",
"futuredatascience/from-classifier-v0",
"SEGAgentRL/LLDS-R-GSPO-Qwen2.5-3B-Ins",
"1010happy/claude_max_max7_perblock35-Qwen2-5-3B-Instruct-seed10",
"1010happy/Teacher_r14_train_gptmini_all7-Qwen2-5-3B-Instruct-seed896",
"fpadovani/jpn-jpan-10mb-after-ppt-Dp-100mb-ckpt500_seed455",
"saheedniyi/YarnGPT-local",
"beleata74/bg-tts-v7",
"shubhamprakash108/qwen3-vl-chartqa-vllm-full-dataset-3-epoch",
"boltuix/NeuroBERT-NER",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-100mb-ckpt500_seed455",
"Pyjay/sentence-transformers-multilingual-snli-v2-500k",
"Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit",
"allura-org/Gemma-3-Glitter-12B",
"Muennighoff/SGPT-125M-mean-nli-linear5",
"Muennighoff/SGPT-125M-weightedmean-nli-bitfit",
"Muennighoff/SGPT-125M-mean-nli-bitfit",
"Muennighoff/SGPT-1.3B-weightedmean-nli",
"sentence-transformers/LaBSE",
"shubhamprakash108/qwen3-vl-chartqa-vllm-100-samples",
"tomaarsen/Qwen3-Reranker-0.6B-seq-cls",
"sergeyzh/rubert-large-uncased-sts",
"shubhamprakash108/qwen3-vl-chartqa-v1-10k-samples",
"shubhamprakash108/qwen3-vl-chartqa-v1-full-data-one-epoch",
"sbintuitions/sarashina-embedding-v2-1b",
"nomic-ai/modernbert-embed-base",
"m3hrdadfi/roberta-zwnj-wnli-mean-tokens",
"m3hrdadfi/bert-zwnj-wnli-mean-tokens",
"m3hrdadfi/distilbert-zwnj-wnli-mean-tokens",
"mixedbread-ai/mxbai-edge-colbert-v0-32m",
"lokeshch19/ModernPubMedBERT",
"ligolab/DxRoberta",
"lightonai/ColBERT-Zero",
"kinit/slovakbert-sts-stsb",
"keepitreal/vietnamese-sbert",
"jhgan/ko-sroberta-sts",
"gradguy/qwen-2b-chat-finetune",
"Nhat1904/4_shot_STA",
"shrinivasbjoshi/setfit-mbti-multiclass-w266_Nov29",
"Etelis/rtm_fewshot",
"Etelis/YELP_fewshot",
"shrinivasbjoshi/setfit-mbti-multiclass-w266",
]
MTHREADS_MODELS = [
@@ -748,10 +723,12 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交第十九轮过滤结果MetaX_c-500(20) / Kunlunxin_p-800(16) / hygon_k100-ai(35) /
# Cambricon_mlu-370-x8(32) / Biren_166m(6),共109个;沿用多账号 fallback 轮转
# 本轮提交第二十五轮过滤结果MetaX_c-500(8) / Kunlunxin_p-800(19) / hygon_k100-ai(40) /
# Cambricon_mlu-370-x8(16) / Biren_166m(1),共84个;沿用多账号 fallback 轮转
# hygon_k100-ai 本轮恢复提交(上一轮 v1.0.31 为补交 zhoushasha 失败模型而清空过其列表)。
# 本轮不提交 Mthreads_s4000保留既有列表/ ppu_zw_810e机制B无白名单权限/
# Sunrise_pt-200-x1v1.0.13已完成)/ Iluvatar_bi-150无config分支且本轮筛选为0
# Sunrise_pt-200-x1v1.0.13已完成)/
# Iluvatar_bi-150本轮筛选为0且本仓库 framework=vllm现有 iluvatar 镜像均为 llamacpp/GGUF缺 vllm 版镜像)
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),