diff --git a/main.py b/main.py index 45f3873..2b40ecf 100644 --- a/main.py +++ b/main.py @@ -58,175 +58,102 @@ ACCOUNTS: List[Tuple[str, str, str]] = [ # 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) # ══════════════════════════════════════════════════════════ METAX_MODELS = [ - "barandinho/Qwen3-30B-A3B-FIRST-STAGE-SFT-V2", - "hotmailuser/QwenSlerp2-14B", - "WhiteRabbitNeo/WhiteRabbitNeo-33B-v1.5", - "madox81/SmolLM2-135M-cybersecurity-lora-merged", - "Xlnk/LFM2-2.6B-Exp-GGuf", - "Tesslate/UIGEN-T1.1-Qwen-14B", - "jondurbin/bagel-dpo-34b-v0.2", - "zhengr/MixTAO-7Bx2-MoE-Instruct-v5.0", - "bjaidi/Phi-3-medium-128k-instruct-awq", - "jacob-ml/jacob-24b", - "geoffmunn/Qwen3-32B-f16", - "TorpedoSoftware/Luau-Devstral-24B-Instruct-v0.2", - "TeichAI/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill", - "tongzang/Qwen2.5-7b-lora-law", - "prithivMLmods/Sombrero-QwQ-32B-Elite9", - "prithivMLmods/Sombrero-QwQ-32B-Elite10-Fixed", - "TeichAI/Qwen3-14B-Polaris-Alpha-Distill", - "okwinds/MiroThinker-14B-DPO-v0.1", - "sanbuphy/tianji-wish2-14b", - "YOYO-AI/YOYO-O1-14B", - "LLM-Research/Meta-Llama-3.1-405B", - "LLM-Research/Meta-Llama-3-70B", - "LLM-Research/Meta-Llama-3.1-70B", - "Qwen/Qwen-72B-Chat", - "Qwen/Qwen3-Coder-480B-A35B-Instruct", - "deepseek-ai/DeepSeek-R1-Distill-Llama-70B", - "codefuse-ai/CodeFuse-StarCoder2-15B", - "AI-ModelScope/txgemma-27b-chat", - "XGenerationLab/XiYanSQL-QwenCoder-32B-2412", - "OpenBuddy/openbuddy-qwen1.5-32b-v21.2-32k", - "OpenBuddy/openbuddy-thinker-32b-v26-preview", - "OpenBuddy/openbuddy-qwen1.5-32b-v21.1-32k", - "OpenBuddy/openbuddy-qwq-32b-v25.2q-200k", - "unsloth/Qwen3-30B-A3B", - "OpenBuddy/openbuddy-qwq-32b-v25.1-200k", - "OpenBuddy/openbuddy-r1-32b-v24.1-200k", - "iic/ERank-14B", - "OpenBuddy/openbuddy-yi1.5-34b-v21.2-32k", - "LGAI-EXAONE/EXAONE-Deep-32B", - "OpenBuddy/openbuddy-qwq-32b-v24.2-200k", - "unsloth/Phi-3-mini-4k-instruct-v0", - "argilla/notux-8x7b-v1", - "voidful/qd-phi-1_5", - "TechxGenus-MS/starcoder2-15b-instruct", - "m-a-p/OpenLLaMA-Reproduce-872.42B", - "m-a-p/OpenLLaMA-Reproduce-973.08B", - "Shanghai_AI_Laboratory/OREAL-32B", - "YOYO-AI/Qwen3-30B-A3B-CoderThinking-YOYO-linear", - "smirki/UIGEN-T1.1-Qwen-14B", - "sthenno-com/miscii-14b-0130", - "prithivMLmods/Qwen2.5-32B-DeepSeek-R1-Instruct", - "sail/Sailor2-20B-128K", - "xverse/XVERSE-65B", - "TeleAI/TeleChat-52B", - "modelscope/Llama-2-70b-ms", - "Shanghai_AI_Laboratory/internlm2-20b", - "ai-modelscope/Llama-3_1-Nemotron-51B-Instruct", - "aJupyter/EmoLLM_Qwen2-7B-Instruct_lora", - "zhuangxialie/Phi-3-Chinese-ORPO", - "vllm-ascend/QwQ-32B-W8A8", - "ZhipuAI/GLM-4-32B-0414", + "InstantX/FLUX.1-dev-IP-Adapter", + "Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B", + "strangerzone/Flux-Animex-v2-LoRA", + "tclf90/qwen2.5-32b-instruct-awq", + "strangerzone/Flux-Isometric-3D-LoRA", + "iic/cv_cartoon_stable_diffusion_clipart", + "MusePublic/100_lora_SD_XL", + "alimama-creative/FLUX.1-Turbo-Alpha", ] KUNLUNXIN_MODELS = [ - "Xlnk/LFM2-2.6B-Exp-GGuf", + "boltuix/NeuroBERT-NER", + "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2", + "jfarray/Model_bert-base-multilingual-uncased_5_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_5_Epochs", + "cross-encoder/ms-marco-MiniLM-L6-v2", + "tomaarsen/Qwen3-Reranker-0.6B-seq-cls", + "sergeyzh/rubert-large-uncased-sts", + "sbintuitions/sarashina-embedding-v2-1b", + "nomic-ai/modernbert-embed-base", + "m3hrdadfi/roberta-zwnj-wnli-mean-tokens", + "m3hrdadfi/bert-zwnj-wnli-mean-tokens", + "m3hrdadfi/distilbert-zwnj-wnli-mean-tokens", + "mixedbread-ai/mxbai-edge-colbert-v0-32m", + "lokeshch19/ModernPubMedBERT", + "ligolab/DxRoberta", + "lightonai/ColBERT-Zero", + "kinit/slovakbert-sts-stsb", + "keepitreal/vietnamese-sbert", + "jhgan/ko-sroberta-sts", ] BIREN_MODELS = [ - "allenai/OLMo-2-0425-1B", - "Free2035/4QDR_4B_AD_Thinker_V1", - "aifoundry-org/OLMo-7B-0424-hf-Quantized", - "lugman-madhiai/Qwen3-4B-MHS-1.1", - "zypchn/BehChat-SFT-v4", - "NoesisLab/Kai-30B-Instruct", - "barandinho/Qwen3-30B-A3B-FIRST-STAGE-SFT", - "m-a-p/OpenLLaMA-Reproduce-218.1B", - "xiaolesu/Qwen3-8B-Herald-SFT", - "WhiteRabbitNeo/WhiteRabbitNeo-33B-v1.5", - "saleh1312/orph_3.07225", - "vanta-research/atom-olmo3-7b", - "ZhipuAI/LongCite-glm4-9b", - "Xlnk/LFM2-2.6B-Exp-GGuf", - "Tesslate/UIGEN-T1.1-Qwen-14B", - "jondurbin/bagel-dpo-34b-v0.2", - "zhengr/MixTAO-7Bx2-MoE-Instruct-v5.0", - "allenai/Olmo-3.1-32B-Instruct", - "bjaidi/Phi-3-medium-128k-instruct-awq", - "xing720310/qwen3-14b", - "IntelLabs/sqft-mistral-7b-v0.3-50-base-gptq", - "hariharanv04/qwen2.5-coder-14b-metadata-merged", - "junfengzhou/qwen3-14b-rl", - "ronnywebdevs1/Affine-P011-5CkU7wLMWXPs6TdSsMf8eEYCVAbPLyNmYg9PPx1Uds8toKra", - "kennedyantonio0301/Affine-Tensor-h3-5EkdoaCmEpFffUjDpLhDMzEDR4kptaEzpTPYCP1uL2sbct8C", - "julep-ai/dolphin-2.9-llama3-70b-awq", - "cortexso/gemma3", - "jacob-ml/jacob-24b", - "lyraaaa/neuralese-sft-pretrain-v2", - "ai-sage/GigaChat-20B-A3B-instruct-bf16", - "PJMixers-Dev/gemma-3-1b-it-fixed", - "commotion/svara_finetune_v1", - "geoffmunn/Qwen3-14B-f16", - "geoffmunn/Qwen3-32B-f16", - "TeichAI/Nemotron-Cascade-14B-Thinking-Claude-4.5-Opus-High-Reasoning-Distill", - "prithivMLmods-llamafile/SmolLM2-1.7B-Instruct-llamafile", - "prithivMLmods-llamafile/Llama-3.2-8B-llamafile-200K", - "llamafile-club/SmolLM-135M-Instruct-Llamafile", - "prithivMLmods/Sombrero-QwQ-32B-Elite9", - "prithivMLmods-llamafile/Aya-Expanse-8B-llamafile", - "llamafile-club/SmolLM-135M-Llamafile", - "prithivMLmods/Sombrero-QwQ-32B-Elite10-Fixed", - "prithivMLmods-llamafile/Qwen2.5-Coder-1.5B-llamafile", - "TeichAI/Qwen3-14B-Polaris-Alpha-Distill", - "okwinds/MiroThinker-14B-DPO-v0.1", - "sanbuphy/tianji-wish2-14b", - "codefuse-ai/CodeFuse-StarCoder2-15B", - "AI-ModelScope/txgemma-27b-chat", - "Shanghai_AI_Laboratory/internlm3-8b-instruct-awq", - "XGenerationLab/XiYanSQL-QwenCoder-32B-2412", - "vllm-ascend/gemma-1.1-2b-it", - "OpenBuddy/openbuddy-qwen1.5-32b-v21.2-32k", - "OpenBuddy/openbuddy-thinker-32b-v26-preview", - "OpenBuddy/openbuddy-qwen1.5-32b-v21.1-32k", - "TechxGenus-MS/CodeGemma-7b", - "OpenBuddy/openbuddy-qwq-32b-v25.2q-200k", - "unsloth/Qwen3-30B-A3B", - "OpenBuddy/openbuddy-qwq-32b-v25.1-200k", - "OpenBuddy/openbuddy-r1-32b-v24.1-200k", - "iic/ERank-14B", - "OpenBuddy/openbuddy-yi1.5-34b-v21.2-32k", - "LGAI-EXAONE/EXAONE-Deep-32B", - "OpenBuddy/openbuddy-qwq-32b-v24.2-200k", - "unsloth/Phi-3-mini-4k-instruct-v0", - "argilla/notux-8x7b-v1", - "voidful/qd-phi-1_5", - "Shanghai_AI_Laboratory/internlm2-math-base-20b", - "Shanghai_AI_Laboratory/internlm2-math-plus-20b", - "TechxGenus-MS/starcoder2-15b-instruct", - "Shanghai_AI_Laboratory/internlm2-base-20b", - "m-a-p/OpenLLaMA-Reproduce-872.42B", - "m-a-p/OpenLLaMA-Reproduce-973.08B", - "Shanghai_AI_Laboratory/OREAL-32B", - "YOYO-AI/Qwen3-30B-A3B-CoderThinking-YOYO-linear", - "ticoAg/Qwen-1_8B-Chat-Int4-awq", - "smirki/UIGEN-T1.1-Qwen-14B", - "prithivMLmods/Qwen2.5-32B-DeepSeek-R1-Instruct", - "sail/Sailor2-20B-128K", - "xverse/XVERSE-65B", - "Shanghai_AI_Laboratory/internlm2_5-20b-chat", - "TeleAI/TeleChat-52B", - "modelscope/Llama-2-70b-ms", - "Shanghai_AI_Laboratory/internlm2-20b", - "ai-modelscope/Llama-3_1-Nemotron-51B-Instruct", - "zhuangxialie/Phi-3-Chinese-ORPO", - "openai-mirror/gpt-oss-safeguard-20b", - "ByteDance-Seed/Seed-OSS-36B-Instruct", - "Shanghai_AI_Laboratory/internlm-chat-20b", - "TurkuNLP/bloom-finnish-176b", - "openai-mirror/gpt-oss-120b", - "vllm-ascend/QwQ-32B-W8A8", - "mistralai/Mistral-Small-24B-Instruct-2501", - "Shanghai_AI_Laboratory/internlm-20b", - "ZhipuAI/GLM-4-32B-0414", + "Data-Juicer/LLaMA-1B-dj-refine-150B-instruct-4.7B", ] CAMBRICON_MODELS = [ - "Xlnk/LFM2-2.6B-Exp-GGuf", + "GwadaDLT/whisper-base-gcf", + "Pyjay/sentence-transformers-multilingual-snli-v2-500k", + "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2", + "Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit", + "jfarray/Model_bert-base-multilingual-uncased_5_Epochs", + "Muennighoff/SGPT-125M-mean-nli-bitfit", + "cross-encoder/ms-marco-MiniLM-L6-v2", + "sergeyzh/rubert-large-uncased-sts", + "sbintuitions/sarashina-embedding-v2-1b", + "nomic-ai/modernbert-embed-base", + "m3hrdadfi/roberta-zwnj-wnli-mean-tokens", + "m3hrdadfi/distilbert-zwnj-wnli-mean-tokens", + "mixedbread-ai/mxbai-edge-colbert-v0-32m", + "ligolab/DxRoberta", + "lightonai/ColBERT-Zero", + "kinit/slovakbert-sts-stsb", ] HYGON_MODELS = [ + "SEGAgentRL/LLDS-R-GSPO-Qwen2.5-3B-Ins", + "1010happy/claude_max_max7_perblock35-Qwen2-5-3B-Instruct-seed10", + "1010happy/Teacher_r14_train_gptmini_all7-Qwen2-5-3B-Instruct-seed896", + "fpadovani/jpn-jpan-10mb-after-ppt-Dp-100mb-ckpt500_seed455", + "saheedniyi/YarnGPT-local", + "beleata74/bg-tts-v7", + "shubhamprakash108/qwen3-vl-chartqa-vllm-full-dataset-3-epoch", + "boltuix/NeuroBERT-NER", + "fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-100mb-ckpt500_seed455", + "Pyjay/sentence-transformers-multilingual-snli-v2-500k", + "Muennighoff/SGPT-2.7B-weightedmean-nli-bitfit", + "allura-org/Gemma-3-Glitter-12B", + "Muennighoff/SGPT-125M-mean-nli-linear5", + "Muennighoff/SGPT-125M-weightedmean-nli-bitfit", + "Muennighoff/SGPT-125M-mean-nli-bitfit", + "Muennighoff/SGPT-1.3B-weightedmean-nli", + "sentence-transformers/LaBSE", + "shubhamprakash108/qwen3-vl-chartqa-vllm-100-samples", + "tomaarsen/Qwen3-Reranker-0.6B-seq-cls", + "sergeyzh/rubert-large-uncased-sts", + "shubhamprakash108/qwen3-vl-chartqa-v1-10k-samples", + "shubhamprakash108/qwen3-vl-chartqa-v1-full-data-one-epoch", + "sbintuitions/sarashina-embedding-v2-1b", + "nomic-ai/modernbert-embed-base", + "m3hrdadfi/roberta-zwnj-wnli-mean-tokens", + "m3hrdadfi/bert-zwnj-wnli-mean-tokens", + "m3hrdadfi/distilbert-zwnj-wnli-mean-tokens", + "mixedbread-ai/mxbai-edge-colbert-v0-32m", + "lokeshch19/ModernPubMedBERT", + "ligolab/DxRoberta", + "lightonai/ColBERT-Zero", + "kinit/slovakbert-sts-stsb", + "keepitreal/vietnamese-sbert", + "jhgan/ko-sroberta-sts", + "gradguy/qwen-2b-chat-finetune", + "Nhat1904/4_shot_STA", + "shrinivasbjoshi/setfit-mbti-multiclass-w266_Nov29", + "Etelis/rtm_fewshot", + "Etelis/YELP_fewshot", + "shrinivasbjoshi/setfit-mbti-multiclass-w266", ] MTHREADS_MODELS = [ @@ -796,17 +723,16 @@ PPU_MODELS = [ "espressovi/BODHI-qwen-3-maze-8b-distil", ] -# 本轮补交 zhoushasha 仓库 v1.0.37 因「请先执行下载模型任务」失败的 157 个模型: -# MetaX_c-500(61) / Kunlunxin_p-800(1) / Cambricon_mlu-370-x8(1) / Biren_166m(94)。 -# 原因:机制A(zhoushasha,create-contest-task)要求模型必须已下载到平台存储; -# 本仓库走机制B(/api/adapt/task/add,传 modelAddress 的 HuggingFace URL), -# 平台会自行拉取,不需要预先下载,因此这批模型改由本仓库提交。 -# 本轮不提交 hygon_k100-ai(列表已清空)/ Mthreads_s4000(保留既有列表)/ -# ppu_zw_810e(机制B无白名单权限)/ Sunrise_pt-200-x1(v1.0.13已完成)/ -# Iluvatar_bi-150(本仓库 framework=vllm,现有 iluvatar 镜像均为 llamacpp/GGUF,缺 vllm 版镜像) +# 本轮提交第二十五轮过滤结果:MetaX_c-500(8) / Kunlunxin_p-800(19) / hygon_k100-ai(40) / +# Cambricon_mlu-370-x8(16) / Biren_166m(1),共84个;沿用多账号 fallback 轮转。 +# hygon_k100-ai 本轮恢复提交(上一轮 v1.0.31 为补交 zhoushasha 失败模型而清空过其列表)。 +# 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/ +# Sunrise_pt-200-x1(v1.0.13已完成)/ +# Iluvatar_bi-150(本轮筛选为0;且本仓库 framework=vllm,现有 iluvatar 镜像均为 llamacpp/GGUF,缺 vllm 版镜像) GPU_JOBS: List[Tuple[str, List[str]]] = [ ("MetaX_c-500", METAX_MODELS), ("Kunlunxin_p-800", KUNLUNXIN_MODELS), + ("hygon_k100-ai", HYGON_MODELS), ("Cambricon_mlu-370-x8", CAMBRICON_MODELS), ("Biren_166m", BIREN_MODELS), ]