Compare commits

...

1 Commits

Author SHA1 Message Date
zhouyuanxi
8b8a900288 submit 405 verified-elsewhere models across four GPUs 2026-09-24 22:36:13 +08:00
6 changed files with 445 additions and 519 deletions

View File

@@ -1,14 +1,16 @@
# xc_validation_strategy_vllm_zhouyuanxi
批量向 ModelHub XC 平台提交模型适配任务的策略服务(zhouyuanxi 账号,zhoukaile xc-Token),
之后保持 HTTP 服务存活供平台探活。
部署在 zhouyuanxi 账号下的模型适配策略。任务通过 `zhangyuanxi`、`jiajing`、`l112233`、`l11223344` 四个账号的 XC Token 平均轮转提交;之后保持 HTTP 服务存活供平台探活。
本轮使用 2026-09-24 的成功下载、非量化模型清单,只提交目标 GPU 尚无验证记录、且其他 GPU 至少一张「已验证」的模型:`Biren_166m` 6 个、`Cambricon_mlu-370-x8` 179 个、`Kunlunxin_p-800` 180 个、`MetaX_c-500` 40 个,共 405 条 GPU/模型任务。PPU 与 Hygon 由另一策略提交,本轮不重复提交。
## 功能
- 通过 `/api/adapt/task/add` 接口(xc-Token 认证)批量提交模型适配任务
- vllm 框架(api chat),Kunlunxin_p-800 GPU
- 从 `model_ids/` 读取本轮四张 GPU 的模型 ID 清单,使用对应的 vLLM 配置
- 某账号命中额度限制 60007 时,切换到下一个活跃账号
- 提交成功的模型写入 `submitted_adapt_tasks.txt`
- 暴露 `/health` 和 `/status` 接口满足平台运行时契约
- 暴露 `/health` 和 `/status` 接口;`/status` 包含各账号、各 GPU 提交数量
## 平台契约说明

549
main.py
View File

@@ -2,16 +2,12 @@
xc_validation_strategy_vllm_zhouyuanxi — 主入口
启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型适配任务
(/api/adapt/task/add,xc-Token 认证)。
(本轮仅提交 MetaX_c-500 / hygon_k100-ai / Cambricon_mlu-370-x8 这 3 张卡;
Kunlunxin_p-800 / Biren_166m / Mthreads_s4000 的 config_content 与模型列表变量
仍保留在代码中,未列入本次 GPU_JOBS,可供后续复用)
(/api/adapt/task/add,xc-Token 认证)。本轮仅提交 2026-09-24 筛出的
Biren_166m / Cambricon_mlu-370-x8 / Kunlunxin_p-800 / MetaX_c-500;
其他 GPU 的 config_content 与模型列表仍保留,但不列入本次 GPU_JOBS。
提交账号采用自动 fallback 轮转:按 ACCOUNTS 列表顺序提交,一旦当前账号命中
平台的"异步验证任务数量已达上限"限制(错误码 60007),自动切换到下一个
账号继续提交同一个模型,直至全部账号额度用尽。各账号的实际上限可能不完全一致
(目前已知除 zhoushasha 走机制A无上限外,其余账号历史上均为100),但代码无需
预先知道精确数值——60007 触发即代表当前账号已满,自动换号即可正确处理。
提交账号按 ACTIVE_ACCOUNTS 平均轮转;若某账号命中额度限制 60007,
跳过该账号并尝试下一账号提交当前模型。
之后保持 HTTP 服务存活,暴露 /health(K8s 探活)和 /status(运行状态)。
"""
@@ -22,6 +18,7 @@ import signal
import threading
from datetime import datetime
from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer
from pathlib import Path
from typing import List, Tuple
import requests
@@ -55,7 +52,7 @@ ACCOUNTS: List[Tuple[str, str, str]] = [
# 本轮实际参与提交的账号(平均轮转只在这几个之间进行)。
# 留空 [] 表示使用 ACCOUNTS 里的全部账号。
# v1.1.0 按要求只用这 4 个;其余 6 个保留在 ACCOUNTS 里备用,不会丢失 token。
# 沿用上一轮指定的 4 个活跃账号;其余 6 个保留在 ACCOUNTS 里备用。
ACTIVE_ACCOUNT_LABELS: List[str] = [
"zhangyuanxi", "jiajing", "l112233", "l11223344",
]
@@ -66,499 +63,29 @@ ACTIVE_ACCOUNTS: List[Tuple[str, str, str]] = (
)
# ══════════════════════════════════════════════════════════
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果)
# 各 GPU 的模型列表
# ══════════════════════════════════════════════════════════
METAX_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B",
"MusePublic/stable-diffusion-xl-base",
"emrevrg/Norovox-Alpha-MoE-1.2B",
"emrevrg/Norovox-Alpha-MoE-3.9B",
"DCAgent/g1_clean_hybrid_25k_32b",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"sapidlabs/Sparkulator-GLM-5.2",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"iamsiddj/EducatorHelperModel",
"fpadovani/jpn-jpan-100mb-after-ppt-Dp-100mb-ckpt500_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"anicka/ke-v9-8b",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-10mb_seed10",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"LamNguyen0904/vistral-medical-adapter",
"Jolieb/tinyllama-lora-object-sorting",
"nessy-studio/poison-gemma",
"fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407",
"flywheel-ai/real-estate",
"famseamus/LFM2.5-DCR-8B-A1B",
"Blackfrost-AI/Lumix-4B",
"ibm-granite/granite-34b-code-base-8k",
"microsoft/Dayhoff-3b-UR90-10000",
"microsoft/Dayhoff-3b-UR90-10",
"developer-lunark/Qwen3-30B-Korean-Roleplay",
"kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo",
"trl-internal-testing/tiny-Phi3ForCausalLM-3.5",
"dfgertg/idk",
"LeVraiCNL/ornith_finetune_v3",
"yuchen-zhu-zyc/HybridDiffusion-2B",
"bardsai/finance-sentiment-zh-fast",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455",
"berkbirkan/gemma-3-lora-finetune-x-replies",
"nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"ngocnamk3er/dsi_transformers_code_t5_base_python",
"TheDrummer/Big-Tiger-Gemma-27B-v1",
"trashpanda-org/QwQ-32B-Snowdrop-v0",
"WizardLMTeam/WizardCoder-33B-V1.1",
"Tesslate/UIGEN-X-32B-0727",
"AscendKernelGen/KernelGen-LM-32B",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"ibm-granite/granite-4.1-30b-base",
"open-thoughts/OpenThinkerAgent-32B",
"zai-org/chatglm-6b",
"drbaph/s2-pro-fp8",
"Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16",
"groxaxo/s2-pro-BnB-4Bits",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"morphllm/dspark-glm52-draft",
"kanishka/opt-babylm1_no_preemption_laugh_seed-211_5e-6",
"bachvnju/qwen3-0.6b-coder",
"xpuenabler/gpt-oss-15.5b-23E-SFT",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"Pageshift-Entertainment/pagestorm-research-preview-24b-first-chapter-only",
"pki/nova-24b-cybersec",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
]
MODEL_DIR = Path(__file__).resolve().parent / "model_ids"
KUNLUNXIN_MODELS = [
"AI-ModelScope/granite-20b-code-base",
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4",
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16",
"AI-ModelScope/granite-20b-code-instruct-8k",
"AI-ModelScope/granite-20b-code-base-8k",
"openbmb/MiniCPM4-8B-marlin-cpmcu",
"AI-ModelScope/granite-20b-code-instruct",
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"iamsiddj/EducatorHelperModel",
"google/gemma-2b-cpp",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"anicka/ke-v9-8b",
"EBLANSoft/eblangpt-falos67",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"malaiwah/GLM-5.2-SIQ-Fruit-Instruct",
"fpadovani/eng-latn-100mb-ppt-shuff-dyck-100mb_seed10",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407",
"flywheel-ai/real-estate",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"lsm0729/Qwen2.5-VL-3B-Instruct-quantized.w8a8",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"cjos/my-awesome-setfit-model",
"litert-community/Ministral-3-3B-Reasoning-2512",
"mizzaay/6de7a1b5",
"MU-Kindai/SBERT-JSNLI-base",
"JoBeer/multi-qa-mpnet-base-dot-v1-eclass",
"pkshatech/simcse-ja-bert-base-clcmlp",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-hybrid",
"louisbetsch/new-classification-model",
"aammari/setfit-zero-shot-classification-pbsp-p3-cons",
"JoBeer/all-mpnet-base-v2-eclass",
"arithmetic-circuit-overloading/gpt2-64D-1L-4H",
"aammari/setfit-zero-shot-classification-pbsp-p3-trig",
"gart-labor/eng-distilBERT-se-eclass",
"arithmetic-circuit-overloading/gpt2-256D-1L-8H",
"gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"fawazatvetted/fine_tuned_mpnetv2",
"leerobert/my-awesome-setfit-model",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"lewtun/setfit-minilm-distilled-test",
"aparna1595/bert-mpnet-sentence",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"mssongit/fndeberta-sentence",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"aammari/setfit-zero-shot-classification-pbsp-p3-dur",
"aammari/setfit-zero-shot-classification-pbsp-p3-freq",
"dlicari/distil-ita-legal-bert",
"aammari/setfit-zero-shot-classification-pbsp-p3-bhvr",
"dlicari/sentence-ita-eurlex-bert-base",
"lsanochkin/setfit-rubert-intent",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"microsoft/VibeVoice-Realtime-0.5B",
"ShwetActhq/dummy_setfit",
"gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenVoiceOS/canary-qwen-2.5b-onnx",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"aammari/setfit-zero-shot-classification-pbsp-p1",
"meta-llama/Prompt-Guard-86M",
"kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"kornwtp/ConGen-simcse-model-roberta-base-thai",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"lmxhappy/brand_bert",
"kamalkraj/BioSimCSE-BioLinkBERT-BASE",
"lmxhappy/tiyu_bert",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8",
"futuredatascience/action-classifier-v2",
"LoneStriker/Orca-2-13b-5.0bpw-h6-exl2",
"futuredatascience/to-classifier-v2",
"futuredatascience/from-classifier-v2",
"shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30",
]
BIREN_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B",
"emrevrg/Norovox-Alpha-MoE-1.2B",
"emrevrg/Norovox-Alpha-MoE-3.9B",
"AI-ModelScope/granite-20b-code-base",
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4",
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16",
"AI-ModelScope/granite-20b-code-instruct-8k",
"openbmb/MiniCPM4-8B-marlin-cpmcu",
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"RadixArk/Qwen3.8-27B-DSpark",
"iamsiddj/EducatorHelperModel",
"google/gemma-2b-cpp",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"EBLANSoft/eblangpt-falos67",
"ilhkn/my-awesome-setfit-model",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"EleutherAI/quirky-pythia-410m-mixture",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"nomic-ai/nomic-embed-text-v2-moe",
"Jolieb/tinyllama-lora-object-sorting",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Xenova/pythia-410m-deduped",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"nessy-studio/poison-gemma",
"flywheel-ai/real-estate",
"Pacific-i64/TR-MOE-306",
"bartowski/internlm2-chat-20b-llama-old",
"farbodtavakkoli/OTel-LLM-E4B-IT",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"famseamus/LFM2.5-DCR-8B-A1B",
"narendarcodes/adaption-sec-financial-arithmetic-109b",
"narendarcodes/adaption-gpt-oss-120b-telugu-instruct",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"Blackfrost-AI/Lumix-4B",
"developer-lunark/Qwen3-30B-Korean-Roleplay",
"kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo",
"LLM-Research/Phi-4-mini-flash-reasoning",
"ib-ssm/mamba2-8b-3t-4k-hf",
"dfgertg/idk",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"riccardozaccone96/flexrank-llama3.2-1B",
"yuchen-zhu-zyc/HybridDiffusion-2B",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"cjos/my-awesome-setfit-model",
"BananaMind/BananaMind-2-Nano",
"litert-community/Ministral-3-3B-Reasoning-2512",
"livadies/Bonsai-27B-Android-Local",
"blockblockblock/Qwen2.5-0.5B-Instruct-exl3-3.0bpw",
"WizardLMTeam/WizardCoder-33B-V1.1",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"Tesslate/UIGEN-X-32B-0727",
"AscendKernelGen/KernelGen-LM-32B",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"open-thoughts/OpenThinkerAgent-32B",
"drbaph/s2-pro-fp8",
"groxaxo/s2-pro-BnB-4Bits",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"Qwen/Qwen-AgentWorld-35B-A3B",
"jinxing6609/olmo3-7b-zh-merged",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"allenai/MolmoAct-7B-D-Pretrain-0812",
"allenai/MolmoAct-7B-D-LIBERO-Object-0812",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"pki/nova-24b-cybersec",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"litert-community/gemma-3-270m-it",
"LoneStriker/Orca-2-13b-5.0bpw-h6-exl2",
]
def load_model_ids(filename: str) -> List[str]:
model_ids = [
line.strip()
for line in (MODEL_DIR / filename).read_text(encoding="utf-8").splitlines()
if line.strip()
]
if not model_ids or len(model_ids) != len(set(model_ids)):
raise ValueError(f"模型列表为空或含重复 ID: {filename}")
return model_ids
CAMBRICON_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B",
"emrevrg/Norovox-Alpha-MoE-1.2B",
"emrevrg/Norovox-Alpha-MoE-3.9B",
"AI-ModelScope/granite-20b-code-base",
"llm-jp/llm-jp-4-32b-a3b-thinking",
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4",
"YOYO-AI/ZYH-LLM-Qwen2.5-14B-V2",
"DCAgent/g1_clean_hybrid_25k_32b",
"amd/gpt-oss-20b-BF16-w8a8-llmcompressor",
"KoboldAI/fairseq-dense-13B-Janeway",
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16",
"AI-ModelScope/granite-20b-code-instruct-8k",
"openbmb/MiniCPM4-8B-marlin-cpmcu",
"AI-ModelScope/granite-20b-code-instruct",
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"sapidlabs/Sparkulator-GLM-5.2",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"Zynerji/Ektome-Qwen3-VL-4Bi-PristinelyUncensored",
"Zynerji/Ektome-Qwen3-VL-2Bi-PristinelyUncensored",
"iamsiddj/EducatorHelperModel",
"vorenthiclabs/vorenthos-vision-thinking-qwq-7b",
"lodestones/gemma-7b-flax",
"google/gemma-2b-cpp",
"jinaai/jina-reranker-v3.5",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"anicka/ke-v9-8b",
"EBLANSoft/eblangpt-falos67",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"TurkuNLP/web-register-classification-multilingual",
"malaiwah/GLM-5.2-SIQ-Fruit-Instruct",
"nomic-ai/nomic-embed-text-v2-moe",
"Udoba45/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-tall_thorny_boar",
"VerStella/Qwen3.8-27B-heretic-ara-W8A8-DCU",
"LamNguyen0904/vistral-medical-adapter",
"Jolieb/tinyllama-lora-object-sorting",
"ibm-granite/granite-embedding-30m-sparse",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Undi95/Mistral-11B-OmniMix",
"Xenova/pythia-410m-deduped",
"Undi95/Mistral-11B-CC-Air",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"nessy-studio/poison-gemma",
"Undi95/Mistral-11B-Airoboros-v0.1",
"flywheel-ai/real-estate",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"llm-semantic-router/mmbert-fact-check-merged",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"berkbirkan/gemma-3-lora-finetune-x-replies",
"nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"cjos/my-awesome-setfit-model",
"OpenMed/OpenMed-PII-French-BioClinicalBERT-Base-110M-v1",
"seerware/granite-embedding-30m-sparse",
"MU-Kindai/SBERT-JSNLI-base",
"OpenMed/OpenMed-PII-French-BiomedELECTRA-Large-335M-v1",
"JoBeer/multi-qa-mpnet-base-dot-v1-eclass",
"OpenMed/OpenMed-PII-French-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-French-BiomedBERT-Large-340M-v1",
"infgrad/Prism-Qwen3.5-Reranker-4B",
"pkshatech/simcse-ja-bert-base-clcmlp",
"RCouronnePEReN/gpt2_finetuned_overfit-10epochs-128tokens",
"q-future/Q-ReAlign-Pro-9B",
"vrfai/gemma-4-12B-it-fp8",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"OpenMed/OpenMed-PII-German-BioClinicalBERT-Base-110M-v1",
"louisbetsch/new-classification-model",
"Trendyol/Trendyol-LLM-Asure-12B",
"OpenMed/OpenMed-PII-German-BiomedELECTRA-Large-335M-v1",
"OpenMed/OpenMed-PII-German-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-German-BiomedBERT-Base-110M-v1",
"aammari/setfit-zero-shot-classification-pbsp-p3-cons",
"JoBeer/all-mpnet-base-v2-eclass",
"BalaRajesh1/mmbert-small-nli",
"aammari/setfit-zero-shot-classification-pbsp-p3-trig",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"quanda-bench-test/gpt2-small-trex-openwebtext-hf",
"quanda-bench-test/gpt2-small-trex-hf",
"quanda-bench-test/gpt2-small-trex-wikitext-ft-hf",
"quanda-bench-test/gpt2-small-trex-wikitext-hf",
"quanda-bench-test/gpt2-small-trex-openwebtext-ft-hf",
"quanda-bench-test/gpt2-small-trex-ft-hf",
"gart-labor/eng-distilBERT-se-eclass",
"Pakorn2112/Orpheus-TTS-hmong-3b",
"OpenMed/OpenMed-PII-Italian-BiomedBERT-Base-110M-v1",
"OpenMed/OpenMed-PII-Italian-BioClinicalBERT-Base-110M-v1",
"gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Large-335M-v1",
"ans2004/aragpt2-transport-autocomplete",
"fawazatvetted/fine_tuned_mpnetv2",
"Auparima/thaifood-embed",
"OpenMed/OpenMed-PII-Italian-BiomedBERT-Large-340M-v1",
"OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Base-110M-v1",
"fishaudio/s2-pro",
"drbaph/s2-pro-fp8",
"leerobert/my-awesome-setfit-model",
"OpenMed/OpenMed-PII-Spanish-BioClinicalBERT-Base-110M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedBERT-Large-340M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedBERT-Base-110M-v1",
"groxaxo/s2-pro-BnB-4Bits",
"ReconOut/granite-embedding-english-r2",
"Imagilux/fishaudio-s2-pro",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"lewtun/setfit-minilm-distilled-test",
"morphllm/dspark-glm52-draft",
"tomaarsen/jina-embeddings-v3-hf",
"ibm-granite/granite-embedding-311m-multilingual-r2",
"aparna1595/bert-mpnet-sentence",
"ibm-granite/granite-embedding-97m-multilingual-r2",
"FINAL-Bench/Darwin-TTS-1.7B-Cross",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"jinaai/jina-embeddings-v3-hf",
"gluschenko/omnivoice-onnx",
"mssongit/fndeberta-sentence",
"splendor1811/omnivoice-vietnamese",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"yugeshkarunamurthy/Ornith-1.0-9B-oQe6",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"yugeshkarunamurthy/Ornith-1.0-9B-oQe3.5",
"aammari/setfit-zero-shot-classification-pbsp-p3-dur",
"aammari/setfit-zero-shot-classification-pbsp-p3-freq",
"dlicari/distil-ita-legal-bert",
"maya-multimodal/Qwen3.5-9B-aerialsim-rl-step100",
"aammari/setfit-zero-shot-classification-pbsp-p3-bhvr",
"dlicari/sentence-ita-eurlex-bert-base",
"lsanochkin/setfit-rubert-intent",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"microsoft/VibeVoice-Realtime-0.5B",
"Qwen/Qwen-AgentWorld-35B-A3B",
"ShwetActhq/dummy_setfit",
"gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenVoiceOS/canary-qwen-2.5b-onnx",
"nvidia/nemotron-labs-audio-visual-flamingo-hf",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"aammari/setfit-zero-shot-classification-pbsp-p1",
"meta-llama/Prompt-Guard-86M",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"kornwtp/ConGen-simcse-model-roberta-base-thai",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"EleutherAI/pythia-1.4b-addition-first-ft",
"gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"allenai/MolmoAct-7B-D-Pretrain-0812",
"allenai/MolmoAct-7B-D-LIBERO-Spatial-0812",
"allenai/MolmoAct-7B-D-LIBERO-Object-0812",
"lmxhappy/brand_bert",
"kamalkraj/BioSimCSE-BioLinkBERT-BASE",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"lmxhappy/tiyu_bert",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"shrinivasbjoshi/r3-w266-setfit-mbti-noempath-multiclass-hypsearch-mpnet-dec1",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8",
"futuredatascience/action-classifier-v2",
"futuredatascience/to-classifier-v2",
"futuredatascience/from-classifier-v2",
"shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30",
]
METAX_MODELS = load_model_ids("MetaX_c-500_2026-09-24.txt")
KUNLUNXIN_MODELS = load_model_ids("Kunlunxin_p-800_2026-09-24.txt")
BIREN_MODELS = load_model_ids("Biren_166m_2026-09-24.txt")
CAMBRICON_MODELS = load_model_ids("Cambricon_mlu-370-x8_2026-09-24.txt")
HYGON_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B",
@@ -2019,25 +1546,14 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil",
]
# 本轮提交「放宽口径」的筛选结果:MetaX_c-500(89) / Kunlunxin_p-800(104) /
# hygon_k100-ai(811) / Cambricon_mlu-370-x8(188) / Iluvatar_bi-150(75) /
# Biren_166m(99),共 1366 个。
#
# 筛选条件②从「别的卡已验证」放宽为「别的卡已验证 或 验证中」:
# 正在验证说明模型已通过平台基本检查(格式/唯一性),只是还没出结果。
# 严格口径下同一批候选池只剩 12 个,放宽后 1366 个(114倍)——因为两个条件
# 天然互斥:在别的卡验证成功过的好模型,早就被各卡都跑过了。
#
# 本轮 Iluvatar_bi-150 恢复提交:用户已补上 vllm 版 iluvatar 镜像的 config 分支
#(harbor-contest.4pd.io/luopingyi/enginex-iluvatar-bi150/vllm:0.8.3)。
# 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/
# Sunrise_pt-200-x1(v1.0.13已完成)
# 本轮使用 2026-09-24 已成功下载、非量化、目标卡无验证记录,
# 且其他卡至少一张「已验证」的模型:Biren(6)、Cambricon(179)、
# Kunlunxin(180)、MetaX(40),共 405 个 GPU/模型任务。
# PPU 和 Hygon 已由 zhoushasha 策略提交,本轮不重复提交。
GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS),
("hygon_k100-ai", HYGON_MODELS),
("Cambricon_mlu-370-x8", CAMBRICON_MODELS),
("Iluvatar_bi-150", ILUVATAR_BI150_MODELS),
("Biren_166m", BIREN_MODELS),
]
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
@@ -2054,6 +1570,7 @@ _state = {
"submitted": 0,
"failed": 0,
"per_account": {label: 0 for label, _, _ in ACTIVE_ACCOUNTS},
"per_gpu": {gpu: 0 for gpu, _ in GPU_JOBS},
"current_account": ACTIVE_ACCOUNTS[0][0],
"started_at": None,
"finished_at": None,
@@ -2408,6 +1925,7 @@ def _run_worker():
if submitted_ok:
_state["submitted"] += 1
_state["per_gpu"][gpu_type] += 1
successful.append(f"{gpu_type}\t{model_id}")
else:
_state["failed"] += 1
@@ -2423,7 +1941,8 @@ def _run_worker():
_state["phase"] = "done"
print(
f"[worker] 完成 submitted={_state['submitted']} failed={_state['failed']} "
f"total={_state['total']} per_account={_state['per_account']}",
f"total={_state['total']} per_account={_state['per_account']} "
f"per_gpu={_state['per_gpu']}",
flush=True,
)
# 提交完成后继续保持进程存活,等待平台停止

View File

@@ -0,0 +1,6 @@
kaividlabs/qwen3-4b-awq
quyetdev/qwen3_8B_v3_fine_tuned_awq
zerofata/MS3.2-PaintedFantasy-v3-24B
ibm-granite/granite-4.1-30b
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
waltonfuture/qwen2.5vl-3b-32b-longest-5153

View File

@@ -0,0 +1,179 @@
kaividlabs/qwen3-4b-awq
glins7/cashgo-role_classification
futuredatascience/from-classifier-v1
kowshik/upsc-classification-model-v1
lewispons/large-email-classifier
YouLiXiya/tinyllava-v1.0-1.1b-hf
javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final
Vishwas/intent_classification
mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection
kornwtp/ConGen-RoBERTa-base
kornwtp/ConGen-BERT-Small
kornwtp/ConGen-TinyBERT-L4
kornwtp/ConGen-BERT-Mini
kornwtp/ConGen-BERT-Tiny
TingChenChang/cMedQA2-multi-qa-mpnet-zh
dvilasuero/my-test-setfit
mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR
jamescalam/mpnet-nli-sts
jamescalam/mpnet-snli-negatives
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness
firqaaa/indo-sentence-bert-base
income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b
ceggian/sbert_standard_reddit_mnr
DMetaSoul/sbert-chinese-qmc-domain-v1-distill
sentence-transformers/msmarco-distilbert-base-v4
DMetaSoul/sbert-chinese-qmc-domain-v1
mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04
whaleloops/phrase-bert
valurank/paraphrase-mpnet-base-v2-offensive
usc-isi/sbert-roberta-large-anli-mnli-snli
uer/sbert-base-chinese-nli
symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli
symanto/sn-mpnet-base-snli-mnli
sentence-transformers/xlm-r-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-bert-base-nli-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens
sentence-transformers/stsb-roberta-large
sentence-transformers/stsb-roberta-base
sentence-transformers/stsb-roberta-base-v2
sentence-transformers/stsb-distilroberta-base-v2
sentence-transformers/stsb-distilbert-base
sentence-transformers/sentence-t5-xxl
sentence-transformers/sentence-t5-xl
sentence-transformers/sentence-t5-base
sentence-transformers/roberta-large-nli-stsb-mean-tokens
sentence-transformers/roberta-large-nli-mean-tokens
sentence-transformers/roberta-base-nli-mean-tokens
sentence-transformers/quora-distilbert-base
sentence-transformers/paraphrase-distilroberta-base-v2
sentence-transformers/paraphrase-distilroberta-base-v1
sentence-transformers/paraphrase-albert-small-v2
sentence-transformers/paraphrase-albert-base-v2
sentence-transformers/paraphrase-TinyBERT-L6-v2
sentence-transformers/nli-roberta-large
sentence-transformers/nli-roberta-base
sentence-transformers/nli-roberta-base-v2
sentence-transformers/nli-distilroberta-base-v2
iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online
iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online
iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online
iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch
iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online
sentence-transformers/nli-distilbert-base
sentence-transformers/nli-bert-large
sentence-transformers/gtr-t5-xxl
sentence-transformers/gtr-t5-xl
dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch
sentence-transformers/nli-bert-large-cls-pooling
Mozilla/llava-v1.5-7b-llamafile
MathLLMs/MathCoder-VL-2B
Mantis-VL/llava_siglip_llama3_8b_finetune_8192
sentence-transformers/nli-bert-base-cls-pooling
sentence-transformers/multi-qa-distilbert-dot-v1
sentence-transformers/multi-qa-distilbert-cos-v1
sentence-transformers/msmarco-distilbert-dot-v5
sentence-transformers/msmarco-distilbert-cos-v5
sentence-transformers/msmarco-distilbert-base-v2
sentence-transformers/msmarco-distilbert-base-dot-prod-v3
sentence-transformers/msmarco-bert-co-condensor
sentence-transformers/msmarco-bert-base-dot-v5
ydyajyA/Llama-2-13b-hf
sentence-transformers/gtr-t5-large
q2792046875/internVL1B
muse/openai-clip-vit-large-patch14
sentence-transformers/gtr-t5-base
sentence-transformers/facebook-dpr-question_encoder-single-nq-base
sentence-transformers/facebook-dpr-question_encoder-multiset-base
sentence-transformers/distilbert-base-nli-stsb-quora-ranking
llava-hf/llava-v1.6-vicuna-7b-hf
sentence-transformers/facebook-dpr-ctx_encoder-multiset-base
jinaai/jina-embeddings-v3
sentence-transformers/distilroberta-base-msmarco-v1
sentence-transformers/distilroberta-base-msmarco-v2
sentence-transformers/distilbert-base-nli-mean-tokens
Vchitect/ShotVL-3B
Qwen/Qwen3-VL-2B-Thinking
OpenGVLab/VideoChat-R1_7B
yasserrmd/deepseek-esg-assistant
Bingdo/dcug_pdf_mixtral_nemo_base_12b
unsloth/gemma-3-4b-it
unsloth/gemma-3-12b-it
theprint/phi-3-mini-4k-gamedev
simonlesaumon/Mistral-NeMo-12B-Unslopper-FR-v1
reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled
starVLA/Qwen3-VL-4B-Instruct-Action
mistralai/Pixtral-12B-2409
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP
DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full
waltonfuture/qwen2.5vl-3b-aha-7b-distilled
mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3
waltonfuture/qwen2.5vl-3b-best
jeremyhola/LORAs
osanseviero/clip-st
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
new5558/simcse-model-wangchanberta-base-att-spm-uncased
navteca/multi-qa-mpnet-base-cos-v1
navteca/all-mpnet-base-v2
nanopass/test-model-fe
mrp/simcse-model-m-bert-thai-cased
mrm8488/roberta-base-bne-finetuned-sqac-retriever
laion/openthoughts-4-code-qwen3-32b-annotated-32k_qwen3-1.7B_32k
OpenGVLab/InternVL3-1B-Instruct
OpenGVLab/InternVL2_5-8B-MPO
OpenGVLab/InternVL2_5-2B-MPO
OpenGVLab/InternVL2_5-2B
sakares/wav2vec2-large-xlsr-thai-demo
cahya/wav2vec2-large-xlsr-indonesian
indonesian-nlp/wav2vec2-large-xlsr-indonesian-baseline
indonesian-nlp/wav2vec2-large-xlsr-indonesian
m3hrdadfi/wav2vec2-large-xlsr-persian-v3
nguyenvulebinh/wav2vec2-base-vietnamese-250h
airesearch/wav2vec2-large-xlsr-53-th
indonesian-nlp/wav2vec2-indonesian-javanese-sundanese
ctl/wav2vec2-large-xlsr-cantonese
jonatasgrosman/wav2vec2-large-xlsr-53-persian
jonatasgrosman/wav2vec2-large-xlsr-53-arabic
muzamil47/wav2vec2-large-xlsr-53-arabic-demo
prithivMLmods/Qwen2-VL-OCR-2B-Instruct
waltonfuture/qwen2.5vl-3b-sampled_10000_qwen2.5vl_sc
waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b
MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ
waltonfuture/qwen2.5vl-3b-rl-sft
waltonfuture/qwen2.5vl-3b-sampled_10000_reflection-cot-7b
waltonfuture/qwen2.5vl-3b-32b_shuffle
waltonfuture/qwen2.5vl-3b-caption-cot-7b
waltonfuture/qwen2.5vl-3b-32b-longest-5153
waltonfuture/qwen2.5vl-3b-self-critic-cot
waltonfuture/qwen2.5vl-3b-sampled_10000_mixed-reflection-cot-32b
waltonfuture/qwen2.5vl-3b-sampled_15000_reflection-cot-32b
kresnik/wav2vec2-large-xlsr-korean
mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1
zhaokaikai/Qwen2.5-VL-3B-Instruct-Traffic
waltonfuture/qwen2.5vl-3b-32b-longest-25767
waltonfuture/qwen2.5vl-3b-32b-wrong-response
waltonfuture/qwen2.5vl-3b-sampled_all_qwen2.5vl32b
OpenMed/Qwen2.5-3B-MedVL
maxidl/wav2vec2-large-xlsr-german
imvladikon/wav2vec2-xls-r-300m-hebrew
dbdmg/wav2vec2-xls-r-300m-italian-robust
mikr/whisper-large-v3-czech-cv13
prithivMLmods/ChemQwen-vL
ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0
jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA
whitefox123/w2v-bert-2.0-arabic-4
Finnish-NLP/wav2vec2-xlsr-1b-finnish-lm-v2
01ai/Yi-VL-6B
AI-ModelScope/bert-base-uncased
Qwen/Qwen3-VL-4B-Instruct
Bidwill/whisper-small-sanskrit
Baraa123R/whisper-finetuned-TheArabMaghreb2
Apel-sin/whisper-large-v3-russian-ties-podlodka-v1.2
Finnish-NLP/wav2vec2-xlsr-300m-finnish-lm
GetmanY1/wav2vec2-large-fi-150k-finetuned
groxaxo/octen-embedding-8b-w4a16
unsloth/orpheus-3b-0.1-ft
cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged
ayoubkirouane/whisper-small-ar

View File

@@ -0,0 +1,180 @@
glins7/cashgo-role_classification
futuredatascience/from-classifier-v1
kowshik/upsc-classification-model-v1
YouLiXiya/tinyllava-v1.0-1.1b-hf
javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final
Vishwas/intent_classification
airnicco8/xlm-roberta-en-it-de
tubyneto/wandss-bert
nategro/nps-mpnet-lds
mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection
kornwtp/ConGen-RoBERTa-base
kornwtp/ConGen-TinyBERT-L6
kornwtp/ConGen-BERT-Small
kornwtp/ConGen-TinyBERT-L4
kornwtp/ConGen-BERT-Tiny
TingChenChang/hpv-multi-qa-mpnet-zh
Charul/my-dummy-model-1
TingChenChang/cMedQA2-multi-qa-mpnet-zh
dvilasuero/my-test-setfit
dvilasuero/setfit-mini-imdb
mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR
bongsoo/moco-sentencedistilbertV2.1
jamescalam/mpnet-nli-sts
TingChenChang/hpvqa-lcqmc-ocnli-cnsd-multi-MiniLM-v2
TingChenChang/lcqmc-ocnli-cnsd-multi-MiniLM-v2
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_data_coverage
valhalla/distilbart-mnli-12-9
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness
jamescalam/mpnet-qa
jamescalam/deberta-v3-base-qa
firqaaa/indo-sentence-bert-base
bongsoo/moco-sentencebertV2.0
smartmind/roberta-ko-small-tsdae
aiknowyou/all-mpnet-base-questions-clustering-en
lewtun/dummy-setfit-model
TingChenChang/qqp-nli-training-paraphrase-multilingual-MiniLM-L12-v2
bongsoo/moco-sentencedistilbertV2.0
edumunozsala/bertin-sts-cc-news-es
smartmind/ko-sbert-augSTS-maxlength512
spacemanidol/esci-es-mpnet-crossencoder
spacemanidol/esci-mpnet-crossencoder
embedding-data/distilroberta-base-sentence-transformer
sdadas/st-polish-paraphrase-from-mpnet
sorayutmild/simcse-model-wangchanberta-finetuned-sanook-news
aiknowyou/aiky-sentence-bertino
NimaBoscarino/STPushToHub-test
alfaneo/bertimbaulaw-base-portuguese-sts
WalidLak/Testmodel
shafin/distilbert-similarity-b32-3
guidecare/all-mpnet-base-v2-feature-extraction
income/bpr-gpl-climate-fever-base-msmarco-distilbert-tas-b
income/bpr-gpl-hotpotqa-base-msmarco-distilbert-tas-b
income/bpr-gpl-nfcorpus-base-msmarco-distilbert-tas-b
income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b
income/bpr-gpl-webis-touche2020-base-msmarco-distilbert-tas-b
ITESM/sentece-embeddings-BETO
espejelomar/sentece-embeddings-BETO
ceggian/sbert_pt_reddit_mnr_128
ceggian/sbert_pt_reddit_softmax_512
GPL/bioasq-msmarco-distilbert-gpl
GPL/nfcorpus-tsdae-msmarco-distilbert-gpl
GPL/dbpedia-entity-tsdae-msmarco-distilbert-gpl
GPL/quora-distilbert-tas-b-gpl-self_miner
ceggian/sbert_standard_reddit_mnr
snunlp/KR-SBERT-V40K-klueNLI-augSTS
GPL/trec-news-tsdae-msmarco-distilbert-gpl
GPL/fever-tsdae-msmarco-distilbert-gpl
GPL/dbpedia-entity-msmarco-distilbert-gpl
mrp/SimCSE-model-WangchanBERTa-V2
GPL/scifact-distilbert-tas-b-gpl-self_miner
sentence-transformers/stsb-bert-large
sentence-transformers/stsb-bert-base
sentence-transformers/sentence-t5-large
sentence-transformers/quora-distilbert-multilingual
GPL/arguana-tsdae-msmarco-distilbert-gpl
GPL/trec-covid-msmarco-distilbert-gpl
GPL/webis-touche2020-msmarco-distilbert-gpl
GPL/trec-news-msmarco-distilbert-gpl
GPL/nq-msmarco-distilbert-gpl
GPL/climate-fever-msmarco-distilbert-gpl
GPL/newsqa-msmarco-distilbert-gpl
ddobokki/unsup-simcse-klue-roberta-small
GPL/arguana-msmarco-distilbert-gpl
sentence-transformers/use-cmlm-multilingual
bespin-global/klue-sroberta-base-continue-learning-by-mnr
somosnlp-hackathon-2022/paraphrase-spanish-distilroberta
somosnlp-hackathon-2022/bertin-roberta-base-finetuning-esnli
sentence-transformers/xlm-r-base-en-ko-nli-ststb
sentence-transformers/multi-qa-mpnet-base-dot-v1
sentence-transformers/msmarco-distilbert-base-v4
morethankk/ThermalGuard-v1_4
DMetaSoul/sbert-chinese-dtm-domain-v1
moshew/paraphrase-mpnet-base-v2_SetFit_sst2
mariolux/sherpa-onnx-whisper-tiny
mariolux/sherpa-onnx-whisper-small
mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04
whaleloops/phrase-bert
mariolux/sherpa-onnx-fire-red-asr-large-zh_en-2025-02-16
longvideotool/LongVT-SFT
valurank/paraphrase-mpnet-base-v2-offensive
symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli
sentence-transformers/xlm-r-bert-base-nli-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens
sentence-transformers/stsb-xlm-r-multilingual
sentence-transformers/stsb-roberta-base
sentence-transformers/stsb-roberta-base-v2
sentence-transformers/stsb-mpnet-base-v2
sentence-transformers/stsb-distilroberta-base-v2
sentence-transformers/stsb-distilbert-base
sentence-transformers/sentence-t5-xxl
sentence-transformers/roberta-large-nli-stsb-mean-tokens
sentence-transformers/roberta-large-nli-mean-tokens
sentence-transformers/roberta-base-nli-stsb-mean-tokens
sentence-transformers/roberta-base-nli-mean-tokens
sentence-transformers/quora-distilbert-base
sentence-transformers/paraphrase-xlm-r-multilingual-v1
sentence-transformers/paraphrase-mpnet-base-v2
sentence-transformers/paraphrase-distilroberta-base-v1
sentence-transformers/paraphrase-albert-small-v2
sentence-transformers/paraphrase-MiniLM-L3-v2
sentence-transformers/paraphrase-MiniLM-L12-v2
sentence-transformers/nli-roberta-large
sentence-transformers/nli-roberta-base
sentence-transformers/nli-roberta-base-v2
sentence-transformers/nli-mpnet-base-v2
sentence-transformers/nli-distilroberta-base-v2
iic/speech_conformer_asr_nat-zh-cn-16k-aishell1-vocab4234-pytorch
iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online
iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online
iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online
iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch
iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online
iic/speech_UniASR_asr_2pass-cantonese-CHS-16k-common-vocab1468-tensorflow1-online
sentence-transformers/nli-distilbert-base
sentence-transformers/nli-bert-large
sentence-transformers/multi-qa-mpnet-base-cos-v1
sentence-transformers/gtr-t5-xxl
sentence-transformers/gtr-t5-xl
dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch
Mozilla/llava-v1.5-7b-llamafile
sentence-transformers/multi-qa-MiniLM-L6-dot-v1
Deeps03/qwen2-1.5b-log-classifier
sentence-transformers/msmarco-distilbert-cos-v5
sentence-transformers/msmarco-distilbert-base-v2
sentence-transformers/msmarco-distilbert-base-dot-prod-v3
sentence-transformers/msmarco-bert-base-dot-v5
sentence-transformers/msmarco-MiniLM-L6-v3
sentence-transformers/msmarco-MiniLM-L12-v3
sentence-transformers/gtr-t5-large
q2792046875/internVL1B
muse/openai-clip-vit-large-patch14
sentence-transformers/gtr-t5-base
sentence-transformers/facebook-dpr-question_encoder-single-nq-base
sentence-transformers/facebook-dpr-question_encoder-multiset-base
sentence-transformers/distilbert-base-nli-stsb-quora-ranking
Vchitect/ShotVL-3B
Bingdo/dcug_pdf_mixtral_nemo_base_12b
unsloth/gemma-3-4b-it
unsloth/gemma-3-12b-it
reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled
starVLA/Qwen3-VL-4B-Instruct-Action
mistralai/Pixtral-12B-2409
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP
DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full
mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3
osanseviero/clip-st
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
new5558/simcse-model-wangchanberta-base-att-spm-uncased
navteca/multi-qa-mpnet-base-cos-v1
navteca/all-mpnet-base-v2
NaClNeZn/Qwen3-1.7B-QLoRA-Shizuku-v1
waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b
MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ
waltonfuture/qwen2.5vl-3b-32b-longest-5153
mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1
ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0
whitefox123/w2v-bert-2.0-arabic-4
unsloth/orpheus-3b-0.1-ft

View File

@@ -0,0 +1,40 @@
rewfueranro/Mechanical_lora
PaperCloud/zju19_minguo_style_lora
wangzai/autumn_bg_style_lora
kaividlabs/qwen3-4b-awq
zerofata/MS3.2-PaintedFantasy-v3-24B
AI-ModelScope/Qwen2vl-Flux
NastasiaM/mbert-loraxs-qa-vanilla
muse/flux1-redux-dev
muse/flux1-canny-dev-lora
iic/multi-modal_chinese_stable_diffusion_v1.0
iic/cv_diffusion_text-to-image-synthesis_tiny
iic/cv_cartoon_stable_diffusion_illustration
amd/stable-diffusion-1.5_io32_amdgpu
MusePublic/89_lora_SD_XL
MAILAND/loco-flux-2.5
EnlZhao/deer_lora
AI-ModelScope/t2iadapter_zoedepth_sd15v1
AI-ModelScope/t2iadapter_sketch_sd15v2
AI-ModelScope/t2iadapter_seg_sd14v1
AI-ModelScope/t2iadapter_depth_sd14v1
AI-ModelScope/t2iadapter_canny_sd15v2
AI-ModelScope/t2iadapter_canny_sd14v1
AI-ModelScope/t2i-adapter-sketch-sdxl-1.0
AI-ModelScope/t2i-adapter-openpose-sdxl-1.0
AI-ModelScope/t2i-adapter-lineart-sdxl-1.0
AI-ModelScope/t2i-adapter-depth-midas-sdxl-1.0
AI-ModelScope/t2i-adapter-canny-sdxl-1.0
AI-ModelScope/sdxl-vae-fp16-fix
AI-ModelScope/controlnet-depth-sdxl-1.0-small
AI-ModelScope/controlnet-depth-sdxl-1.0-mid
AI-ModelScope/controlnet-canny-sdxl-1.0-small
stabilityai/stable-diffusion-3-medium_amdgpu
stabilityai/stable-diffusion-2-1-base
AI-ModelScope/t2iadapter_keypose_sd14v1
AI-ModelScope/controlnet-union-sdxl-1.0-promax
ibm-granite/granite-4.1-30b
waltonfuture/qwen2.5vl-3b-32b-longest-5153
jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA
AI-ModelScope/controlnet-canny-sdxl-1.0
cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged