diff --git a/README.md b/README.md index 8fdb675..4ba62f7 100644 --- a/README.md +++ b/README.md @@ -1,14 +1,16 @@ # xc_validation_strategy_vllm_zhouyuanxi -批量向 ModelHub XC 平台提交模型适配任务的策略服务(zhouyuanxi 账号,zhoukaile xc-Token), -之后保持 HTTP 服务存活供平台探活。 +部署在 zhouyuanxi 账号下的模型适配策略。任务通过 `zhangyuanxi`、`jiajing`、`l112233`、`l11223344` 四个账号的 XC Token 平均轮转提交;之后保持 HTTP 服务存活供平台探活。 + +本轮使用 2026-09-24 的成功下载、非量化模型清单,只提交目标 GPU 尚无验证记录、且其他 GPU 至少一张「已验证」的模型:`Biren_166m` 6 个、`Cambricon_mlu-370-x8` 179 个、`Kunlunxin_p-800` 180 个、`MetaX_c-500` 40 个,共 405 条 GPU/模型任务。PPU 与 Hygon 由另一策略提交,本轮不重复提交。 ## 功能 - 通过 `/api/adapt/task/add` 接口(xc-Token 认证)批量提交模型适配任务 -- vllm 框架(api chat),Kunlunxin_p-800 GPU +- 从 `model_ids/` 读取本轮四张 GPU 的模型 ID 清单,使用对应的 vLLM 配置 +- 某账号命中额度限制 60007 时,切换到下一个活跃账号 - 提交成功的模型写入 `submitted_adapt_tasks.txt` -- 暴露 `/health` 和 `/status` 接口满足平台运行时契约 +- 暴露 `/health` 和 `/status` 接口;`/status` 包含各账号、各 GPU 提交数量 ## 平台契约说明 diff --git a/main.py b/main.py index 841c96e..db68067 100644 --- a/main.py +++ b/main.py @@ -2,16 +2,12 @@ xc_validation_strategy_vllm_zhouyuanxi — 主入口 启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型适配任务 -(/api/adapt/task/add,xc-Token 认证)。 -(本轮仅提交 MetaX_c-500 / hygon_k100-ai / Cambricon_mlu-370-x8 这 3 张卡; -Kunlunxin_p-800 / Biren_166m / Mthreads_s4000 的 config_content 与模型列表变量 -仍保留在代码中,未列入本次 GPU_JOBS,可供后续复用) +(/api/adapt/task/add,xc-Token 认证)。本轮仅提交 2026-09-24 筛出的 +Biren_166m / Cambricon_mlu-370-x8 / Kunlunxin_p-800 / MetaX_c-500; +其他 GPU 的 config_content 与模型列表仍保留,但不列入本次 GPU_JOBS。 -提交账号采用自动 fallback 轮转:按 ACCOUNTS 列表顺序提交,一旦当前账号命中 -平台的"异步验证任务数量已达上限"限制(错误码 60007),自动切换到下一个 -账号继续提交同一个模型,直至全部账号额度用尽。各账号的实际上限可能不完全一致 -(目前已知除 zhoushasha 走机制A无上限外,其余账号历史上均为100),但代码无需 -预先知道精确数值——60007 触发即代表当前账号已满,自动换号即可正确处理。 +提交账号按 ACTIVE_ACCOUNTS 平均轮转;若某账号命中额度限制 60007, +跳过该账号并尝试下一账号提交当前模型。 之后保持 HTTP 服务存活,暴露 /health(K8s 探活)和 /status(运行状态)。 """ @@ -22,6 +18,7 @@ import signal import threading from datetime import datetime from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer +from pathlib import Path from typing import List, Tuple import requests @@ -55,7 +52,7 @@ ACCOUNTS: List[Tuple[str, str, str]] = [ # 本轮实际参与提交的账号(平均轮转只在这几个之间进行)。 # 留空 [] 表示使用 ACCOUNTS 里的全部账号。 -# v1.1.0 按要求只用这 4 个;其余 6 个保留在 ACCOUNTS 里备用,不会丢失 token。 +# 沿用上一轮指定的 4 个活跃账号;其余 6 个保留在 ACCOUNTS 里备用。 ACTIVE_ACCOUNT_LABELS: List[str] = [ "zhangyuanxi", "jiajing", "l112233", "l11223344", ] @@ -66,499 +63,29 @@ ACTIVE_ACCOUNTS: List[Tuple[str, str, str]] = ( ) # ══════════════════════════════════════════════════════════ -# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) +# 各 GPU 的模型列表 # ══════════════════════════════════════════════════════════ -METAX_MODELS = [ - "emrevrg/Norovox-Alpha-MoE-7.0B", - "MusePublic/stable-diffusion-xl-base", - "emrevrg/Norovox-Alpha-MoE-1.2B", - "emrevrg/Norovox-Alpha-MoE-3.9B", - "DCAgent/g1_clean_hybrid_25k_32b", - "CaoruiLi/DefectVideoReward", - "ConstDemi/vikhr-nemo-12b-instruct-r-awq", - "sapidlabs/Sparkulator-GLM-5.2", - "pei39/deepseek_r1_distill_qwen_7b_awq_rag", - "fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43", - "iamsiddj/EducatorHelperModel", - "fpadovani/jpn-jpan-100mb-after-ppt-Dp-100mb-ckpt500_seed10", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44", - "anicka/ke-v9-8b", - "fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407", - "ilhkn/my-awesome-setfit-model", - "fpadovani/eng-latn-10mb-ppt-shuff-dyck-10mb_seed10", - "Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV", - "fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10", - "penupup/quora-distilbert-multilingual-lcqmc-sfa-hr", - "hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot", - "hroth/psais-LaBSE-10shot", - "LamNguyen0904/vistral-medical-adapter", - "Jolieb/tinyllama-lora-object-sorting", - "nessy-studio/poison-gemma", - "fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407", - "flywheel-ai/real-estate", - "famseamus/LFM2.5-DCR-8B-A1B", - "Blackfrost-AI/Lumix-4B", - "ibm-granite/granite-34b-code-base-8k", - "microsoft/Dayhoff-3b-UR90-10000", - "microsoft/Dayhoff-3b-UR90-10", - "developer-lunark/Qwen3-30B-Korean-Roleplay", - "kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo", - "trl-internal-testing/tiny-Phi3ForCausalLM-3.5", - "dfgertg/idk", - "LeVraiCNL/ornith_finetune_v3", - "yuchen-zhu-zyc/HybridDiffusion-2B", - "bardsai/finance-sentiment-zh-fast", - "fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455", - "berkbirkan/gemma-3-lora-finetune-x-replies", - "nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4", - "infgrad/Prism-Qwen3.5-Reranker-0.8B", - "ngocnamk3er/dsi_transformers_code_t5_base_python", - "TheDrummer/Big-Tiger-Gemma-27B-v1", - "trashpanda-org/QwQ-32B-Snowdrop-v0", - "WizardLMTeam/WizardCoder-33B-V1.1", - "Tesslate/UIGEN-X-32B-0727", - "AscendKernelGen/KernelGen-LM-32B", - "charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1", - "ibm-granite/granite-4.1-30b-base", - "open-thoughts/OpenThinkerAgent-32B", - "zai-org/chatglm-6b", - "drbaph/s2-pro-fp8", - "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16", - "groxaxo/s2-pro-BnB-4Bits", - "TomoroAI/tomoro-ai-colqwen3-embed-8b-awq", - "TomoroAI/tomoro-ai-colqwen3-embed-4b-awq", - "aleada/Phi-4-mini-instruct-W4A16", - "aleada/Phi-4-W4A16", - "morphllm/dspark-glm52-draft", - "kanishka/opt-babylm1_no_preemption_laugh_seed-211_5e-6", - "bachvnju/qwen3-0.6b-coder", - "xpuenabler/gpt-oss-15.5b-23E-SFT", - "cyber-pal-security/CyberPal2.0-20B", - "LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN", - "YeungNLP/firefly-baichuan-7b-qlora-sft", - "LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN", - "LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN", - "Qwen/WebWorld-32B", - "24B-Suite/Mergedonia-PROMETHEUS-24B-v1", - "zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit", - "praxisresearch/hf_olmo_32b_em_finrisk_1", - "RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq", - "praxisresearch/hf_olmo_32b_em_finrisk_0", - "praxisresearch/hf_olmo_32b_em_badmed_1", - "praxisresearch/hf_olmo_32b_em_badmed_0", - "Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2", - "Pageshift-Entertainment/pagestorm-research-preview-24b-first-chapter-only", - "pki/nova-24b-cybersec", - "ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B", - "Kwai-AutoSQL/Kwai-AutoSQL-32B", -] +MODEL_DIR = Path(__file__).resolve().parent / "model_ids" -KUNLUNXIN_MODELS = [ - "AI-ModelScope/granite-20b-code-base", - "vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4", - "KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16", - "AI-ModelScope/granite-20b-code-instruct-8k", - "AI-ModelScope/granite-20b-code-base-8k", - "openbmb/MiniCPM4-8B-marlin-cpmcu", - "AI-ModelScope/granite-20b-code-instruct", - "openbmb/MiniCPM4-8B-marlin-Eagle-vLLM", - "CaoruiLi/DefectVideoReward", - "fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43", - "iamsiddj/EducatorHelperModel", - "google/gemma-2b-cpp", - "hroth01/psais-all-MiniLM-L6-v2-20shot", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44", - "anicka/ke-v9-8b", - "EBLANSoft/eblangpt-falos67", - "fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407", - "ilhkn/my-awesome-setfit-model", - "fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10", - "penupup/quora-distilbert-multilingual-lcqmc-sfa-hr", - "hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot", - "hroth/psais-LaBSE-10shot", - "malaiwah/GLM-5.2-SIQ-Fruit-Instruct", - "fpadovani/eng-latn-100mb-ppt-shuff-dyck-100mb_seed10", - "arshiysohrevardi/moeinGTS1.5-1.5b", - "Q1ngMang/LFM2.5-350M-PT-zh_CN", - "fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407", - "flywheel-ai/real-estate", - "hroth/psais-all-MiniLM-L6-v2-1shot", - "stjiris/bert-large-portuguese-cased-legal-tsdae", - "bartowski/deepseek-llm-7b-base-exl2", - "lsm0729/Qwen2.5-VL-3B-Instruct-quantized.w8a8", - "LeVraiCNL/ornith_finetune_v3", - "fawazatvetted/fine_tuned_mpnetv3", - "cjos/my-awesome-setfit-model", - "litert-community/Ministral-3-3B-Reasoning-2512", - "mizzaay/6de7a1b5", - "MU-Kindai/SBERT-JSNLI-base", - "JoBeer/multi-qa-mpnet-base-dot-v1-eclass", - "pkshatech/simcse-ja-bert-base-clcmlp", - "amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid", - "amd/Phi-3.5-mini-instruct-onnx-ryzenai-hybrid", - "louisbetsch/new-classification-model", - "aammari/setfit-zero-shot-classification-pbsp-p3-cons", - "JoBeer/all-mpnet-base-v2-eclass", - "arithmetic-circuit-overloading/gpt2-64D-1L-4H", - "aammari/setfit-zero-shot-classification-pbsp-p3-trig", - "gart-labor/eng-distilBERT-se-eclass", - "arithmetic-circuit-overloading/gpt2-256D-1L-8H", - "gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "fawazatvetted/fine_tuned_mpnetv2", - "leerobert/my-awesome-setfit-model", - "aleada/Phi-4-mini-instruct-W4A16", - "aleada/Phi-4-W4A16", - "lewtun/setfit-minilm-distilled-test", - "aparna1595/bert-mpnet-sentence", - "amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid", - "mssongit/fndeberta-sentence", - "amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu", - "amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid", - "aammari/setfit-zero-shot-classification-pbsp-p3-dur", - "aammari/setfit-zero-shot-classification-pbsp-p3-freq", - "dlicari/distil-ita-legal-bert", - "aammari/setfit-zero-shot-classification-pbsp-p3-bhvr", - "dlicari/sentence-ita-eurlex-bert-base", - "lsanochkin/setfit-rubert-intent", - "LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning", - "microsoft/VibeVoice-Realtime-0.5B", - "ShwetActhq/dummy_setfit", - "gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "OpenVoiceOS/canary-qwen-2.5b-onnx", - "LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN", - "YeungNLP/firefly-baichuan-7b-qlora-sft", - "LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN", - "salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged", - "LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN", - "aammari/setfit-zero-shot-classification-pbsp-p1", - "meta-llama/Prompt-Guard-86M", - "kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2", - "zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit", - "kornwtp/ConGen-simcse-model-roberta-base-thai", - "praxisresearch/hf_olmo_32b_em_finrisk_1", - "gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq", - "praxisresearch/hf_olmo_32b_em_finrisk_0", - "praxisresearch/hf_olmo_32b_em_badmed_1", - "praxisresearch/hf_olmo_32b_em_badmed_0", - "lmxhappy/brand_bert", - "kamalkraj/BioSimCSE-BioLinkBERT-BASE", - "lmxhappy/tiyu_bert", - "ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B", - "Kwai-AutoSQL/Kwai-AutoSQL-32B", - "ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8", - "futuredatascience/action-classifier-v2", - "LoneStriker/Orca-2-13b-5.0bpw-h6-exl2", - "futuredatascience/to-classifier-v2", - "futuredatascience/from-classifier-v2", - "shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30", -] -BIREN_MODELS = [ - "emrevrg/Norovox-Alpha-MoE-7.0B", - "emrevrg/Norovox-Alpha-MoE-1.2B", - "emrevrg/Norovox-Alpha-MoE-3.9B", - "AI-ModelScope/granite-20b-code-base", - "vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4", - "KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16", - "AI-ModelScope/granite-20b-code-instruct-8k", - "openbmb/MiniCPM4-8B-marlin-cpmcu", - "openbmb/MiniCPM4-8B-marlin-Eagle-vLLM", - "CaoruiLi/DefectVideoReward", - "ConstDemi/vikhr-nemo-12b-instruct-r-awq", - "pei39/deepseek_r1_distill_qwen_7b_awq_rag", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43", - "RadixArk/Qwen3.8-27B-DSpark", - "iamsiddj/EducatorHelperModel", - "google/gemma-2b-cpp", - "hroth01/psais-all-MiniLM-L6-v2-20shot", - "devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44", - "EBLANSoft/eblangpt-falos67", - "ilhkn/my-awesome-setfit-model", - "Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV", - "EleutherAI/quirky-pythia-410m-mixture", - "penupup/quora-distilbert-multilingual-lcqmc-sfa-hr", - "nomic-ai/nomic-embed-text-v2-moe", - "Jolieb/tinyllama-lora-object-sorting", - "arshiysohrevardi/moeinGTS1.5-1.5b", - "Xenova/pythia-410m-deduped", - "Q1ngMang/LFM2.5-350M-PT-zh_CN", - "nessy-studio/poison-gemma", - "flywheel-ai/real-estate", - "Pacific-i64/TR-MOE-306", - "bartowski/internlm2-chat-20b-llama-old", - "farbodtavakkoli/OTel-LLM-E4B-IT", - "hroth/psais-all-MiniLM-L6-v2-1shot", - "famseamus/LFM2.5-DCR-8B-A1B", - "narendarcodes/adaption-sec-financial-arithmetic-109b", - "narendarcodes/adaption-gpt-oss-120b-telugu-instruct", - "stjiris/bert-large-portuguese-cased-legal-tsdae", - "bartowski/deepseek-llm-7b-base-exl2", - "Blackfrost-AI/Lumix-4B", - "developer-lunark/Qwen3-30B-Korean-Roleplay", - "kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo", - "LLM-Research/Phi-4-mini-flash-reasoning", - "ib-ssm/mamba2-8b-3t-4k-hf", - "dfgertg/idk", - "LeVraiCNL/ornith_finetune_v3", - "fawazatvetted/fine_tuned_mpnetv3", - "riccardozaccone96/flexrank-llama3.2-1B", - "yuchen-zhu-zyc/HybridDiffusion-2B", - "fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455", - "infgrad/Prism-Qwen3.5-Reranker-0.8B", - "cjos/my-awesome-setfit-model", - "BananaMind/BananaMind-2-Nano", - "litert-community/Ministral-3-3B-Reasoning-2512", - "livadies/Bonsai-27B-Android-Local", - "blockblockblock/Qwen2.5-0.5B-Instruct-exl3-3.0bpw", - "WizardLMTeam/WizardCoder-33B-V1.1", - "amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid", - "Tesslate/UIGEN-X-32B-0727", - "AscendKernelGen/KernelGen-LM-32B", - "charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1", - "open-thoughts/OpenThinkerAgent-32B", - "drbaph/s2-pro-fp8", - "groxaxo/s2-pro-BnB-4Bits", - "TomoroAI/tomoro-ai-colqwen3-embed-8b-awq", - "TomoroAI/tomoro-ai-colqwen3-embed-4b-awq", - "aleada/Phi-4-mini-instruct-W4A16", - "aleada/Phi-4-W4A16", - "amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid", - "amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu", - "amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid", - "cyber-pal-security/CyberPal2.0-20B", - "LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning", - "Qwen/Qwen-AgentWorld-35B-A3B", - "jinxing6609/olmo3-7b-zh-merged", - "LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN", - "LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN", - "Qwen/WebWorld-32B", - "24B-Suite/Mergedonia-PROMETHEUS-24B-v1", - "zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit", - "praxisresearch/hf_olmo_32b_em_finrisk_1", - "RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq", - "praxisresearch/hf_olmo_32b_em_finrisk_0", - "praxisresearch/hf_olmo_32b_em_badmed_1", - "praxisresearch/hf_olmo_32b_em_badmed_0", - "allenai/MolmoAct-7B-D-Pretrain-0812", - "allenai/MolmoAct-7B-D-LIBERO-Object-0812", - "Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2", - "pki/nova-24b-cybersec", - "ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B", - "Kwai-AutoSQL/Kwai-AutoSQL-32B", - "litert-community/gemma-3-270m-it", - "LoneStriker/Orca-2-13b-5.0bpw-h6-exl2", -] +def load_model_ids(filename: str) -> List[str]: + model_ids = [ + line.strip() + for line in (MODEL_DIR / filename).read_text(encoding="utf-8").splitlines() + if line.strip() + ] + if not model_ids or len(model_ids) != len(set(model_ids)): + raise ValueError(f"模型列表为空或含重复 ID: {filename}") + return model_ids -CAMBRICON_MODELS = [ - "emrevrg/Norovox-Alpha-MoE-7.0B", - "emrevrg/Norovox-Alpha-MoE-1.2B", - "emrevrg/Norovox-Alpha-MoE-3.9B", - "AI-ModelScope/granite-20b-code-base", - "llm-jp/llm-jp-4-32b-a3b-thinking", - "vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4", - "YOYO-AI/ZYH-LLM-Qwen2.5-14B-V2", - "DCAgent/g1_clean_hybrid_25k_32b", - "amd/gpt-oss-20b-BF16-w8a8-llmcompressor", - "KoboldAI/fairseq-dense-13B-Janeway", - "KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16", - "AI-ModelScope/granite-20b-code-instruct-8k", - "openbmb/MiniCPM4-8B-marlin-cpmcu", - "AI-ModelScope/granite-20b-code-instruct", - "openbmb/MiniCPM4-8B-marlin-Eagle-vLLM", - "CaoruiLi/DefectVideoReward", - "ConstDemi/vikhr-nemo-12b-instruct-r-awq", - "sapidlabs/Sparkulator-GLM-5.2", - "pei39/deepseek_r1_distill_qwen_7b_awq_rag", - "fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10", - "Zynerji/Ektome-Qwen3-VL-4Bi-PristinelyUncensored", - "Zynerji/Ektome-Qwen3-VL-2Bi-PristinelyUncensored", - "iamsiddj/EducatorHelperModel", - "vorenthiclabs/vorenthos-vision-thinking-qwq-7b", - "lodestones/gemma-7b-flax", - "google/gemma-2b-cpp", - "jinaai/jina-reranker-v3.5", - "hroth01/psais-all-MiniLM-L6-v2-20shot", - "anicka/ke-v9-8b", - "EBLANSoft/eblangpt-falos67", - "fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407", - "ilhkn/my-awesome-setfit-model", - "Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV", - "fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10", - "penupup/quora-distilbert-multilingual-lcqmc-sfa-hr", - "hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot", - "hroth/psais-LaBSE-10shot", - "TurkuNLP/web-register-classification-multilingual", - "malaiwah/GLM-5.2-SIQ-Fruit-Instruct", - "nomic-ai/nomic-embed-text-v2-moe", - "Udoba45/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-tall_thorny_boar", - "VerStella/Qwen3.8-27B-heretic-ara-W8A8-DCU", - "LamNguyen0904/vistral-medical-adapter", - "Jolieb/tinyllama-lora-object-sorting", - "ibm-granite/granite-embedding-30m-sparse", - "arshiysohrevardi/moeinGTS1.5-1.5b", - "Undi95/Mistral-11B-OmniMix", - "Xenova/pythia-410m-deduped", - "Undi95/Mistral-11B-CC-Air", - "Q1ngMang/LFM2.5-350M-PT-zh_CN", - "nessy-studio/poison-gemma", - "Undi95/Mistral-11B-Airoboros-v0.1", - "flywheel-ai/real-estate", - "hroth/psais-all-MiniLM-L6-v2-1shot", - "stjiris/bert-large-portuguese-cased-legal-tsdae", - "bartowski/deepseek-llm-7b-base-exl2", - "llm-semantic-router/mmbert-fact-check-merged", - "LeVraiCNL/ornith_finetune_v3", - "fawazatvetted/fine_tuned_mpnetv3", - "berkbirkan/gemma-3-lora-finetune-x-replies", - "nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4", - "infgrad/Prism-Qwen3.5-Reranker-0.8B", - "cjos/my-awesome-setfit-model", - "OpenMed/OpenMed-PII-French-BioClinicalBERT-Base-110M-v1", - "seerware/granite-embedding-30m-sparse", - "MU-Kindai/SBERT-JSNLI-base", - "OpenMed/OpenMed-PII-French-BiomedELECTRA-Large-335M-v1", - "JoBeer/multi-qa-mpnet-base-dot-v1-eclass", - "OpenMed/OpenMed-PII-French-BiomedELECTRA-Base-110M-v1", - "OpenMed/OpenMed-PII-French-BiomedBERT-Large-340M-v1", - "infgrad/Prism-Qwen3.5-Reranker-4B", - "pkshatech/simcse-ja-bert-base-clcmlp", - "RCouronnePEReN/gpt2_finetuned_overfit-10epochs-128tokens", - "q-future/Q-ReAlign-Pro-9B", - "vrfai/gemma-4-12B-it-fp8", - "amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid", - "OpenMed/OpenMed-PII-German-BioClinicalBERT-Base-110M-v1", - "louisbetsch/new-classification-model", - "Trendyol/Trendyol-LLM-Asure-12B", - "OpenMed/OpenMed-PII-German-BiomedELECTRA-Large-335M-v1", - "OpenMed/OpenMed-PII-German-BiomedELECTRA-Base-110M-v1", - "OpenMed/OpenMed-PII-German-BiomedBERT-Base-110M-v1", - "aammari/setfit-zero-shot-classification-pbsp-p3-cons", - "JoBeer/all-mpnet-base-v2-eclass", - "BalaRajesh1/mmbert-small-nli", - "aammari/setfit-zero-shot-classification-pbsp-p3-trig", - "charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1", - "quanda-bench-test/gpt2-small-trex-openwebtext-hf", - "quanda-bench-test/gpt2-small-trex-hf", - "quanda-bench-test/gpt2-small-trex-wikitext-ft-hf", - "quanda-bench-test/gpt2-small-trex-wikitext-hf", - "quanda-bench-test/gpt2-small-trex-openwebtext-ft-hf", - "quanda-bench-test/gpt2-small-trex-ft-hf", - "gart-labor/eng-distilBERT-se-eclass", - "Pakorn2112/Orpheus-TTS-hmong-3b", - "OpenMed/OpenMed-PII-Italian-BiomedBERT-Base-110M-v1", - "OpenMed/OpenMed-PII-Italian-BioClinicalBERT-Base-110M-v1", - "gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Large-335M-v1", - "ans2004/aragpt2-transport-autocomplete", - "fawazatvetted/fine_tuned_mpnetv2", - "Auparima/thaifood-embed", - "OpenMed/OpenMed-PII-Italian-BiomedBERT-Large-340M-v1", - "OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Base-110M-v1", - "fishaudio/s2-pro", - "drbaph/s2-pro-fp8", - "leerobert/my-awesome-setfit-model", - "OpenMed/OpenMed-PII-Spanish-BioClinicalBERT-Base-110M-v1", - "OpenMed/OpenMed-PII-Spanish-BiomedELECTRA-Base-110M-v1", - "OpenMed/OpenMed-PII-Spanish-BiomedBERT-Large-340M-v1", - "OpenMed/OpenMed-PII-Spanish-BiomedBERT-Base-110M-v1", - "groxaxo/s2-pro-BnB-4Bits", - "ReconOut/granite-embedding-english-r2", - "Imagilux/fishaudio-s2-pro", - "TomoroAI/tomoro-ai-colqwen3-embed-8b-awq", - "TomoroAI/tomoro-ai-colqwen3-embed-4b-awq", - "aleada/Phi-4-mini-instruct-W4A16", - "aleada/Phi-4-W4A16", - "lewtun/setfit-minilm-distilled-test", - "morphllm/dspark-glm52-draft", - "tomaarsen/jina-embeddings-v3-hf", - "ibm-granite/granite-embedding-311m-multilingual-r2", - "aparna1595/bert-mpnet-sentence", - "ibm-granite/granite-embedding-97m-multilingual-r2", - "FINAL-Bench/Darwin-TTS-1.7B-Cross", - "amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid", - "jinaai/jina-embeddings-v3-hf", - "gluschenko/omnivoice-onnx", - "mssongit/fndeberta-sentence", - "splendor1811/omnivoice-vietnamese", - "amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu", - "yugeshkarunamurthy/Ornith-1.0-9B-oQe6", - "amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid", - "yugeshkarunamurthy/Ornith-1.0-9B-oQe3.5", - "aammari/setfit-zero-shot-classification-pbsp-p3-dur", - "aammari/setfit-zero-shot-classification-pbsp-p3-freq", - "dlicari/distil-ita-legal-bert", - "maya-multimodal/Qwen3.5-9B-aerialsim-rl-step100", - "aammari/setfit-zero-shot-classification-pbsp-p3-bhvr", - "dlicari/sentence-ita-eurlex-bert-base", - "lsanochkin/setfit-rubert-intent", - "cyber-pal-security/CyberPal2.0-20B", - "LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning", - "microsoft/VibeVoice-Realtime-0.5B", - "Qwen/Qwen-AgentWorld-35B-A3B", - "ShwetActhq/dummy_setfit", - "gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "OpenVoiceOS/canary-qwen-2.5b-onnx", - "nvidia/nemotron-labs-audio-visual-flamingo-hf", - "LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN", - "YeungNLP/firefly-baichuan-7b-qlora-sft", - "LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN", - "LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning", - "LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN", - "salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged", - "LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN", - "aammari/setfit-zero-shot-classification-pbsp-p1", - "meta-llama/Prompt-Guard-86M", - "Qwen/WebWorld-32B", - "24B-Suite/Mergedonia-PROMETHEUS-24B-v1", - "kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2", - "zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit", - "kornwtp/ConGen-simcse-model-roberta-base-thai", - "praxisresearch/hf_olmo_32b_em_finrisk_1", - "EleutherAI/pythia-1.4b-addition-first-ft", - "gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2", - "RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq", - "praxisresearch/hf_olmo_32b_em_finrisk_0", - "praxisresearch/hf_olmo_32b_em_badmed_1", - "praxisresearch/hf_olmo_32b_em_badmed_0", - "allenai/MolmoAct-7B-D-Pretrain-0812", - "allenai/MolmoAct-7B-D-LIBERO-Spatial-0812", - "allenai/MolmoAct-7B-D-LIBERO-Object-0812", - "lmxhappy/brand_bert", - "kamalkraj/BioSimCSE-BioLinkBERT-BASE", - "Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2", - "lmxhappy/tiyu_bert", - "ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B", - "shrinivasbjoshi/r3-w266-setfit-mbti-noempath-multiclass-hypsearch-mpnet-dec1", - "Kwai-AutoSQL/Kwai-AutoSQL-32B", - "ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8", - "futuredatascience/action-classifier-v2", - "futuredatascience/to-classifier-v2", - "futuredatascience/from-classifier-v2", - "shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30", -] + +METAX_MODELS = load_model_ids("MetaX_c-500_2026-09-24.txt") + +KUNLUNXIN_MODELS = load_model_ids("Kunlunxin_p-800_2026-09-24.txt") + +BIREN_MODELS = load_model_ids("Biren_166m_2026-09-24.txt") + +CAMBRICON_MODELS = load_model_ids("Cambricon_mlu-370-x8_2026-09-24.txt") HYGON_MODELS = [ "emrevrg/Norovox-Alpha-MoE-7.0B", @@ -2019,25 +1546,14 @@ PPU_MODELS = [ "espressovi/BODHI-qwen-3-maze-8b-distil", ] -# 本轮提交「放宽口径」的筛选结果:MetaX_c-500(89) / Kunlunxin_p-800(104) / -# hygon_k100-ai(811) / Cambricon_mlu-370-x8(188) / Iluvatar_bi-150(75) / -# Biren_166m(99),共 1366 个。 -# -# 筛选条件②从「别的卡已验证」放宽为「别的卡已验证 或 验证中」: -# 正在验证说明模型已通过平台基本检查(格式/唯一性),只是还没出结果。 -# 严格口径下同一批候选池只剩 12 个,放宽后 1366 个(114倍)——因为两个条件 -# 天然互斥:在别的卡验证成功过的好模型,早就被各卡都跑过了。 -# -# 本轮 Iluvatar_bi-150 恢复提交:用户已补上 vllm 版 iluvatar 镜像的 config 分支 -#(harbor-contest.4pd.io/luopingyi/enginex-iluvatar-bi150/vllm:0.8.3)。 -# 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/ -# Sunrise_pt-200-x1(v1.0.13已完成) +# 本轮使用 2026-09-24 已成功下载、非量化、目标卡无验证记录, +# 且其他卡至少一张「已验证」的模型:Biren(6)、Cambricon(179)、 +# Kunlunxin(180)、MetaX(40),共 405 个 GPU/模型任务。 +# PPU 和 Hygon 已由 zhoushasha 策略提交,本轮不重复提交。 GPU_JOBS: List[Tuple[str, List[str]]] = [ ("MetaX_c-500", METAX_MODELS), ("Kunlunxin_p-800", KUNLUNXIN_MODELS), - ("hygon_k100-ai", HYGON_MODELS), ("Cambricon_mlu-370-x8", CAMBRICON_MODELS), - ("Iluvatar_bi-150", ILUVATAR_BI150_MODELS), ("Biren_166m", BIREN_MODELS), ] TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS) @@ -2054,6 +1570,7 @@ _state = { "submitted": 0, "failed": 0, "per_account": {label: 0 for label, _, _ in ACTIVE_ACCOUNTS}, + "per_gpu": {gpu: 0 for gpu, _ in GPU_JOBS}, "current_account": ACTIVE_ACCOUNTS[0][0], "started_at": None, "finished_at": None, @@ -2408,6 +1925,7 @@ def _run_worker(): if submitted_ok: _state["submitted"] += 1 + _state["per_gpu"][gpu_type] += 1 successful.append(f"{gpu_type}\t{model_id}") else: _state["failed"] += 1 @@ -2423,7 +1941,8 @@ def _run_worker(): _state["phase"] = "done" print( f"[worker] 完成 submitted={_state['submitted']} failed={_state['failed']} " - f"total={_state['total']} per_account={_state['per_account']}", + f"total={_state['total']} per_account={_state['per_account']} " + f"per_gpu={_state['per_gpu']}", flush=True, ) # 提交完成后继续保持进程存活,等待平台停止 diff --git a/model_ids/Biren_166m_2026-09-24.txt b/model_ids/Biren_166m_2026-09-24.txt new file mode 100644 index 0000000..b624b4f --- /dev/null +++ b/model_ids/Biren_166m_2026-09-24.txt @@ -0,0 +1,6 @@ +kaividlabs/qwen3-4b-awq +quyetdev/qwen3_8B_v3_fine_tuned_awq +zerofata/MS3.2-PaintedFantasy-v3-24B +ibm-granite/granite-4.1-30b +HuggingFaceTB/SmolLM2-ablation-ultrachat-v2 +waltonfuture/qwen2.5vl-3b-32b-longest-5153 diff --git a/model_ids/Cambricon_mlu-370-x8_2026-09-24.txt b/model_ids/Cambricon_mlu-370-x8_2026-09-24.txt new file mode 100644 index 0000000..ac40e67 --- /dev/null +++ b/model_ids/Cambricon_mlu-370-x8_2026-09-24.txt @@ -0,0 +1,179 @@ +kaividlabs/qwen3-4b-awq +glins7/cashgo-role_classification +futuredatascience/from-classifier-v1 +kowshik/upsc-classification-model-v1 +lewispons/large-email-classifier +YouLiXiya/tinyllava-v1.0-1.1b-hf +javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final +Vishwas/intent_classification +mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection +kornwtp/ConGen-RoBERTa-base +kornwtp/ConGen-BERT-Small +kornwtp/ConGen-TinyBERT-L4 +kornwtp/ConGen-BERT-Mini +kornwtp/ConGen-BERT-Tiny +TingChenChang/cMedQA2-multi-qa-mpnet-zh +dvilasuero/my-test-setfit +mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR +jamescalam/mpnet-nli-sts +jamescalam/mpnet-snli-negatives +teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness +firqaaa/indo-sentence-bert-base +income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b +ceggian/sbert_standard_reddit_mnr +DMetaSoul/sbert-chinese-qmc-domain-v1-distill +sentence-transformers/msmarco-distilbert-base-v4 +DMetaSoul/sbert-chinese-qmc-domain-v1 +mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04 +whaleloops/phrase-bert +valurank/paraphrase-mpnet-base-v2-offensive +usc-isi/sbert-roberta-large-anli-mnli-snli +uer/sbert-base-chinese-nli +symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli +symanto/sn-mpnet-base-snli-mnli +sentence-transformers/xlm-r-bert-base-nli-stsb-mean-tokens +sentence-transformers/xlm-r-bert-base-nli-mean-tokens +sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens +sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens +sentence-transformers/stsb-roberta-large +sentence-transformers/stsb-roberta-base +sentence-transformers/stsb-roberta-base-v2 +sentence-transformers/stsb-distilroberta-base-v2 +sentence-transformers/stsb-distilbert-base +sentence-transformers/sentence-t5-xxl +sentence-transformers/sentence-t5-xl +sentence-transformers/sentence-t5-base +sentence-transformers/roberta-large-nli-stsb-mean-tokens +sentence-transformers/roberta-large-nli-mean-tokens +sentence-transformers/roberta-base-nli-mean-tokens +sentence-transformers/quora-distilbert-base +sentence-transformers/paraphrase-distilroberta-base-v2 +sentence-transformers/paraphrase-distilroberta-base-v1 +sentence-transformers/paraphrase-albert-small-v2 +sentence-transformers/paraphrase-albert-base-v2 +sentence-transformers/paraphrase-TinyBERT-L6-v2 +sentence-transformers/nli-roberta-large +sentence-transformers/nli-roberta-base +sentence-transformers/nli-roberta-base-v2 +sentence-transformers/nli-distilroberta-base-v2 +iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online +iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online +iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online +iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch +iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online +sentence-transformers/nli-distilbert-base +sentence-transformers/nli-bert-large +sentence-transformers/gtr-t5-xxl +sentence-transformers/gtr-t5-xl +dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch +sentence-transformers/nli-bert-large-cls-pooling +Mozilla/llava-v1.5-7b-llamafile +MathLLMs/MathCoder-VL-2B +Mantis-VL/llava_siglip_llama3_8b_finetune_8192 +sentence-transformers/nli-bert-base-cls-pooling +sentence-transformers/multi-qa-distilbert-dot-v1 +sentence-transformers/multi-qa-distilbert-cos-v1 +sentence-transformers/msmarco-distilbert-dot-v5 +sentence-transformers/msmarco-distilbert-cos-v5 +sentence-transformers/msmarco-distilbert-base-v2 +sentence-transformers/msmarco-distilbert-base-dot-prod-v3 +sentence-transformers/msmarco-bert-co-condensor +sentence-transformers/msmarco-bert-base-dot-v5 +ydyajyA/Llama-2-13b-hf +sentence-transformers/gtr-t5-large +q2792046875/internVL1B +muse/openai-clip-vit-large-patch14 +sentence-transformers/gtr-t5-base +sentence-transformers/facebook-dpr-question_encoder-single-nq-base +sentence-transformers/facebook-dpr-question_encoder-multiset-base +sentence-transformers/distilbert-base-nli-stsb-quora-ranking +llava-hf/llava-v1.6-vicuna-7b-hf +sentence-transformers/facebook-dpr-ctx_encoder-multiset-base +jinaai/jina-embeddings-v3 +sentence-transformers/distilroberta-base-msmarco-v1 +sentence-transformers/distilroberta-base-msmarco-v2 +sentence-transformers/distilbert-base-nli-mean-tokens +Vchitect/ShotVL-3B +Qwen/Qwen3-VL-2B-Thinking +OpenGVLab/VideoChat-R1_7B +yasserrmd/deepseek-esg-assistant +Bingdo/dcug_pdf_mixtral_nemo_base_12b +unsloth/gemma-3-4b-it +unsloth/gemma-3-12b-it +theprint/phi-3-mini-4k-gamedev +simonlesaumon/Mistral-NeMo-12B-Unslopper-FR-v1 +reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled +starVLA/Qwen3-VL-4B-Instruct-Action +mistralai/Pixtral-12B-2409 +mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP +mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP +DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full +waltonfuture/qwen2.5vl-3b-aha-7b-distilled +mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3 +waltonfuture/qwen2.5vl-3b-best +jeremyhola/LORAs +osanseviero/clip-st +HuggingFaceTB/SmolLM2-ablation-ultrachat-v2 +new5558/simcse-model-wangchanberta-base-att-spm-uncased +navteca/multi-qa-mpnet-base-cos-v1 +navteca/all-mpnet-base-v2 +nanopass/test-model-fe +mrp/simcse-model-m-bert-thai-cased +mrm8488/roberta-base-bne-finetuned-sqac-retriever +laion/openthoughts-4-code-qwen3-32b-annotated-32k_qwen3-1.7B_32k +OpenGVLab/InternVL3-1B-Instruct +OpenGVLab/InternVL2_5-8B-MPO +OpenGVLab/InternVL2_5-2B-MPO +OpenGVLab/InternVL2_5-2B +sakares/wav2vec2-large-xlsr-thai-demo +cahya/wav2vec2-large-xlsr-indonesian +indonesian-nlp/wav2vec2-large-xlsr-indonesian-baseline +indonesian-nlp/wav2vec2-large-xlsr-indonesian +m3hrdadfi/wav2vec2-large-xlsr-persian-v3 +nguyenvulebinh/wav2vec2-base-vietnamese-250h +airesearch/wav2vec2-large-xlsr-53-th +indonesian-nlp/wav2vec2-indonesian-javanese-sundanese +ctl/wav2vec2-large-xlsr-cantonese +jonatasgrosman/wav2vec2-large-xlsr-53-persian +jonatasgrosman/wav2vec2-large-xlsr-53-arabic +muzamil47/wav2vec2-large-xlsr-53-arabic-demo +prithivMLmods/Qwen2-VL-OCR-2B-Instruct +waltonfuture/qwen2.5vl-3b-sampled_10000_qwen2.5vl_sc +waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b +MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ +waltonfuture/qwen2.5vl-3b-rl-sft +waltonfuture/qwen2.5vl-3b-sampled_10000_reflection-cot-7b +waltonfuture/qwen2.5vl-3b-32b_shuffle +waltonfuture/qwen2.5vl-3b-caption-cot-7b +waltonfuture/qwen2.5vl-3b-32b-longest-5153 +waltonfuture/qwen2.5vl-3b-self-critic-cot +waltonfuture/qwen2.5vl-3b-sampled_10000_mixed-reflection-cot-32b +waltonfuture/qwen2.5vl-3b-sampled_15000_reflection-cot-32b +kresnik/wav2vec2-large-xlsr-korean +mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1 +zhaokaikai/Qwen2.5-VL-3B-Instruct-Traffic +waltonfuture/qwen2.5vl-3b-32b-longest-25767 +waltonfuture/qwen2.5vl-3b-32b-wrong-response +waltonfuture/qwen2.5vl-3b-sampled_all_qwen2.5vl32b +OpenMed/Qwen2.5-3B-MedVL +maxidl/wav2vec2-large-xlsr-german +imvladikon/wav2vec2-xls-r-300m-hebrew +dbdmg/wav2vec2-xls-r-300m-italian-robust +mikr/whisper-large-v3-czech-cv13 +prithivMLmods/ChemQwen-vL +ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0 +jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA +whitefox123/w2v-bert-2.0-arabic-4 +Finnish-NLP/wav2vec2-xlsr-1b-finnish-lm-v2 +01ai/Yi-VL-6B +AI-ModelScope/bert-base-uncased +Qwen/Qwen3-VL-4B-Instruct +Bidwill/whisper-small-sanskrit +Baraa123R/whisper-finetuned-TheArabMaghreb2 +Apel-sin/whisper-large-v3-russian-ties-podlodka-v1.2 +Finnish-NLP/wav2vec2-xlsr-300m-finnish-lm +GetmanY1/wav2vec2-large-fi-150k-finetuned +groxaxo/octen-embedding-8b-w4a16 +unsloth/orpheus-3b-0.1-ft +cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged +ayoubkirouane/whisper-small-ar diff --git a/model_ids/Kunlunxin_p-800_2026-09-24.txt b/model_ids/Kunlunxin_p-800_2026-09-24.txt new file mode 100644 index 0000000..4e72925 --- /dev/null +++ b/model_ids/Kunlunxin_p-800_2026-09-24.txt @@ -0,0 +1,180 @@ +glins7/cashgo-role_classification +futuredatascience/from-classifier-v1 +kowshik/upsc-classification-model-v1 +YouLiXiya/tinyllava-v1.0-1.1b-hf +javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final +Vishwas/intent_classification +airnicco8/xlm-roberta-en-it-de +tubyneto/wandss-bert +nategro/nps-mpnet-lds +mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection +kornwtp/ConGen-RoBERTa-base +kornwtp/ConGen-TinyBERT-L6 +kornwtp/ConGen-BERT-Small +kornwtp/ConGen-TinyBERT-L4 +kornwtp/ConGen-BERT-Tiny +TingChenChang/hpv-multi-qa-mpnet-zh +Charul/my-dummy-model-1 +TingChenChang/cMedQA2-multi-qa-mpnet-zh +dvilasuero/my-test-setfit +dvilasuero/setfit-mini-imdb +mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR +bongsoo/moco-sentencedistilbertV2.1 +jamescalam/mpnet-nli-sts +TingChenChang/hpvqa-lcqmc-ocnli-cnsd-multi-MiniLM-v2 +TingChenChang/lcqmc-ocnli-cnsd-multi-MiniLM-v2 +teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_data_coverage +valhalla/distilbart-mnli-12-9 +teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness +jamescalam/mpnet-qa +jamescalam/deberta-v3-base-qa +firqaaa/indo-sentence-bert-base +bongsoo/moco-sentencebertV2.0 +smartmind/roberta-ko-small-tsdae +aiknowyou/all-mpnet-base-questions-clustering-en +lewtun/dummy-setfit-model +TingChenChang/qqp-nli-training-paraphrase-multilingual-MiniLM-L12-v2 +bongsoo/moco-sentencedistilbertV2.0 +edumunozsala/bertin-sts-cc-news-es +smartmind/ko-sbert-augSTS-maxlength512 +spacemanidol/esci-es-mpnet-crossencoder +spacemanidol/esci-mpnet-crossencoder +embedding-data/distilroberta-base-sentence-transformer +sdadas/st-polish-paraphrase-from-mpnet +sorayutmild/simcse-model-wangchanberta-finetuned-sanook-news +aiknowyou/aiky-sentence-bertino +NimaBoscarino/STPushToHub-test +alfaneo/bertimbaulaw-base-portuguese-sts +WalidLak/Testmodel +shafin/distilbert-similarity-b32-3 +guidecare/all-mpnet-base-v2-feature-extraction +income/bpr-gpl-climate-fever-base-msmarco-distilbert-tas-b +income/bpr-gpl-hotpotqa-base-msmarco-distilbert-tas-b +income/bpr-gpl-nfcorpus-base-msmarco-distilbert-tas-b +income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b +income/bpr-gpl-webis-touche2020-base-msmarco-distilbert-tas-b +ITESM/sentece-embeddings-BETO +espejelomar/sentece-embeddings-BETO +ceggian/sbert_pt_reddit_mnr_128 +ceggian/sbert_pt_reddit_softmax_512 +GPL/bioasq-msmarco-distilbert-gpl +GPL/nfcorpus-tsdae-msmarco-distilbert-gpl +GPL/dbpedia-entity-tsdae-msmarco-distilbert-gpl +GPL/quora-distilbert-tas-b-gpl-self_miner +ceggian/sbert_standard_reddit_mnr +snunlp/KR-SBERT-V40K-klueNLI-augSTS +GPL/trec-news-tsdae-msmarco-distilbert-gpl +GPL/fever-tsdae-msmarco-distilbert-gpl +GPL/dbpedia-entity-msmarco-distilbert-gpl +mrp/SimCSE-model-WangchanBERTa-V2 +GPL/scifact-distilbert-tas-b-gpl-self_miner +sentence-transformers/stsb-bert-large +sentence-transformers/stsb-bert-base +sentence-transformers/sentence-t5-large +sentence-transformers/quora-distilbert-multilingual +GPL/arguana-tsdae-msmarco-distilbert-gpl +GPL/trec-covid-msmarco-distilbert-gpl +GPL/webis-touche2020-msmarco-distilbert-gpl +GPL/trec-news-msmarco-distilbert-gpl +GPL/nq-msmarco-distilbert-gpl +GPL/climate-fever-msmarco-distilbert-gpl +GPL/newsqa-msmarco-distilbert-gpl +ddobokki/unsup-simcse-klue-roberta-small +GPL/arguana-msmarco-distilbert-gpl +sentence-transformers/use-cmlm-multilingual +bespin-global/klue-sroberta-base-continue-learning-by-mnr +somosnlp-hackathon-2022/paraphrase-spanish-distilroberta +somosnlp-hackathon-2022/bertin-roberta-base-finetuning-esnli +sentence-transformers/xlm-r-base-en-ko-nli-ststb +sentence-transformers/multi-qa-mpnet-base-dot-v1 +sentence-transformers/msmarco-distilbert-base-v4 +morethankk/ThermalGuard-v1_4 +DMetaSoul/sbert-chinese-dtm-domain-v1 +moshew/paraphrase-mpnet-base-v2_SetFit_sst2 +mariolux/sherpa-onnx-whisper-tiny +mariolux/sherpa-onnx-whisper-small +mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04 +whaleloops/phrase-bert +mariolux/sherpa-onnx-fire-red-asr-large-zh_en-2025-02-16 +longvideotool/LongVT-SFT +valurank/paraphrase-mpnet-base-v2-offensive +symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli +sentence-transformers/xlm-r-bert-base-nli-mean-tokens +sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens +sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens +sentence-transformers/stsb-xlm-r-multilingual +sentence-transformers/stsb-roberta-base +sentence-transformers/stsb-roberta-base-v2 +sentence-transformers/stsb-mpnet-base-v2 +sentence-transformers/stsb-distilroberta-base-v2 +sentence-transformers/stsb-distilbert-base +sentence-transformers/sentence-t5-xxl +sentence-transformers/roberta-large-nli-stsb-mean-tokens +sentence-transformers/roberta-large-nli-mean-tokens +sentence-transformers/roberta-base-nli-stsb-mean-tokens +sentence-transformers/roberta-base-nli-mean-tokens +sentence-transformers/quora-distilbert-base +sentence-transformers/paraphrase-xlm-r-multilingual-v1 +sentence-transformers/paraphrase-mpnet-base-v2 +sentence-transformers/paraphrase-distilroberta-base-v1 +sentence-transformers/paraphrase-albert-small-v2 +sentence-transformers/paraphrase-MiniLM-L3-v2 +sentence-transformers/paraphrase-MiniLM-L12-v2 +sentence-transformers/nli-roberta-large +sentence-transformers/nli-roberta-base +sentence-transformers/nli-roberta-base-v2 +sentence-transformers/nli-mpnet-base-v2 +sentence-transformers/nli-distilroberta-base-v2 +iic/speech_conformer_asr_nat-zh-cn-16k-aishell1-vocab4234-pytorch +iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online +iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online +iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online +iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch +iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online +iic/speech_UniASR_asr_2pass-cantonese-CHS-16k-common-vocab1468-tensorflow1-online +sentence-transformers/nli-distilbert-base +sentence-transformers/nli-bert-large +sentence-transformers/multi-qa-mpnet-base-cos-v1 +sentence-transformers/gtr-t5-xxl +sentence-transformers/gtr-t5-xl +dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch +Mozilla/llava-v1.5-7b-llamafile +sentence-transformers/multi-qa-MiniLM-L6-dot-v1 +Deeps03/qwen2-1.5b-log-classifier +sentence-transformers/msmarco-distilbert-cos-v5 +sentence-transformers/msmarco-distilbert-base-v2 +sentence-transformers/msmarco-distilbert-base-dot-prod-v3 +sentence-transformers/msmarco-bert-base-dot-v5 +sentence-transformers/msmarco-MiniLM-L6-v3 +sentence-transformers/msmarco-MiniLM-L12-v3 +sentence-transformers/gtr-t5-large +q2792046875/internVL1B +muse/openai-clip-vit-large-patch14 +sentence-transformers/gtr-t5-base +sentence-transformers/facebook-dpr-question_encoder-single-nq-base +sentence-transformers/facebook-dpr-question_encoder-multiset-base +sentence-transformers/distilbert-base-nli-stsb-quora-ranking +Vchitect/ShotVL-3B +Bingdo/dcug_pdf_mixtral_nemo_base_12b +unsloth/gemma-3-4b-it +unsloth/gemma-3-12b-it +reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled +starVLA/Qwen3-VL-4B-Instruct-Action +mistralai/Pixtral-12B-2409 +mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP +mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP +DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full +mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3 +osanseviero/clip-st +HuggingFaceTB/SmolLM2-ablation-ultrachat-v2 +new5558/simcse-model-wangchanberta-base-att-spm-uncased +navteca/multi-qa-mpnet-base-cos-v1 +navteca/all-mpnet-base-v2 +NaClNeZn/Qwen3-1.7B-QLoRA-Shizuku-v1 +waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b +MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ +waltonfuture/qwen2.5vl-3b-32b-longest-5153 +mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1 +ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0 +whitefox123/w2v-bert-2.0-arabic-4 +unsloth/orpheus-3b-0.1-ft diff --git a/model_ids/MetaX_c-500_2026-09-24.txt b/model_ids/MetaX_c-500_2026-09-24.txt new file mode 100644 index 0000000..82de4f9 --- /dev/null +++ b/model_ids/MetaX_c-500_2026-09-24.txt @@ -0,0 +1,40 @@ +rewfueranro/Mechanical_lora +PaperCloud/zju19_minguo_style_lora +wangzai/autumn_bg_style_lora +kaividlabs/qwen3-4b-awq +zerofata/MS3.2-PaintedFantasy-v3-24B +AI-ModelScope/Qwen2vl-Flux +NastasiaM/mbert-loraxs-qa-vanilla +muse/flux1-redux-dev +muse/flux1-canny-dev-lora +iic/multi-modal_chinese_stable_diffusion_v1.0 +iic/cv_diffusion_text-to-image-synthesis_tiny +iic/cv_cartoon_stable_diffusion_illustration +amd/stable-diffusion-1.5_io32_amdgpu +MusePublic/89_lora_SD_XL +MAILAND/loco-flux-2.5 +EnlZhao/deer_lora +AI-ModelScope/t2iadapter_zoedepth_sd15v1 +AI-ModelScope/t2iadapter_sketch_sd15v2 +AI-ModelScope/t2iadapter_seg_sd14v1 +AI-ModelScope/t2iadapter_depth_sd14v1 +AI-ModelScope/t2iadapter_canny_sd15v2 +AI-ModelScope/t2iadapter_canny_sd14v1 +AI-ModelScope/t2i-adapter-sketch-sdxl-1.0 +AI-ModelScope/t2i-adapter-openpose-sdxl-1.0 +AI-ModelScope/t2i-adapter-lineart-sdxl-1.0 +AI-ModelScope/t2i-adapter-depth-midas-sdxl-1.0 +AI-ModelScope/t2i-adapter-canny-sdxl-1.0 +AI-ModelScope/sdxl-vae-fp16-fix +AI-ModelScope/controlnet-depth-sdxl-1.0-small +AI-ModelScope/controlnet-depth-sdxl-1.0-mid +AI-ModelScope/controlnet-canny-sdxl-1.0-small +stabilityai/stable-diffusion-3-medium_amdgpu +stabilityai/stable-diffusion-2-1-base +AI-ModelScope/t2iadapter_keypose_sd14v1 +AI-ModelScope/controlnet-union-sdxl-1.0-promax +ibm-granite/granite-4.1-30b +waltonfuture/qwen2.5vl-3b-32b-longest-5153 +jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA +AI-ModelScope/controlnet-canny-sdxl-1.0 +cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged