Compare commits

...

2 Commits
v1.1.0 ... main

Author SHA1 Message Date
zhouyuanxi
8b8a900288 submit 405 verified-elsewhere models across four GPUs 2026-09-24 22:36:13 +08:00
zhouyuanxi
da5b9f8612 restore all 10 accounts to ACCOUNTS; gate the active submitters behind ACTIVE_ACCOUNT_LABELS
The six accounts dropped in v1.1.0 are back in ACCOUNTS so their tokens are not
lost. Which ones actually submit is now controlled by ACTIVE_ACCOUNT_LABELS,
currently the four requested for this round; set it to [] to rotate over all ten.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-09-20 17:20:28 +08:00
6 changed files with 469 additions and 525 deletions

View File

@@ -1,14 +1,16 @@
# xc_validation_strategy_vllm_zhouyuanxi # xc_validation_strategy_vllm_zhouyuanxi
批量向 ModelHub XC 平台提交模型适配任务的策略服务(zhouyuanxi 账号,zhoukaile xc-Token), 部署在 zhouyuanxi 账号下的模型适配策略。任务通过 `zhangyuanxi`、`jiajing`、`l112233`、`l11223344` 四个账号的 XC Token 平均轮转提交;之后保持 HTTP 服务存活供平台探活。
之后保持 HTTP 服务存活供平台探活。
本轮使用 2026-09-24 的成功下载、非量化模型清单,只提交目标 GPU 尚无验证记录、且其他 GPU 至少一张「已验证」的模型:`Biren_166m` 6 个、`Cambricon_mlu-370-x8` 179 个、`Kunlunxin_p-800` 180 个、`MetaX_c-500` 40 个,共 405 条 GPU/模型任务。PPU 与 Hygon 由另一策略提交,本轮不重复提交。
## 功能 ## 功能
- 通过 `/api/adapt/task/add` 接口(xc-Token 认证)批量提交模型适配任务 - 通过 `/api/adapt/task/add` 接口(xc-Token 认证)批量提交模型适配任务
- vllm 框架(api chat),Kunlunxin_p-800 GPU - 从 `model_ids/` 读取本轮四张 GPU 的模型 ID 清单,使用对应的 vLLM 配置
- 某账号命中额度限制 60007 时,切换到下一个活跃账号
- 提交成功的模型写入 `submitted_adapt_tasks.txt` - 提交成功的模型写入 `submitted_adapt_tasks.txt`
- 暴露 `/health` 和 `/status` 接口满足平台运行时契约 - 暴露 `/health` 和 `/status` 接口;`/status` 包含各账号、各 GPU 提交数量
## 平台契约说明 ## 平台契约说明

579
main.py
View File

@@ -2,16 +2,12 @@
xc_validation_strategy_vllm_zhouyuanxi — 主入口 xc_validation_strategy_vllm_zhouyuanxi — 主入口
启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型适配任务 启动后针对 GPU_JOBS 中配置的 GPU 卡分别批量提交各自筛选出的模型适配任务
(/api/adapt/task/add,xc-Token 认证)。 (/api/adapt/task/add,xc-Token 认证)。本轮仅提交 2026-09-24 筛出的
(本轮仅提交 MetaX_c-500 / hygon_k100-ai / Cambricon_mlu-370-x8 这 3 张卡; Biren_166m / Cambricon_mlu-370-x8 / Kunlunxin_p-800 / MetaX_c-500;
Kunlunxin_p-800 / Biren_166m / Mthreads_s4000 的 config_content 与模型列表变量 其他 GPU 的 config_content 与模型列表仍保留,但不列入本次 GPU_JOBS。
仍保留在代码中,未列入本次 GPU_JOBS,可供后续复用)
提交账号采用自动 fallback 轮转:按 ACCOUNTS 列表顺序提交,一旦当前账号命中 提交账号按 ACTIVE_ACCOUNTS 平均轮转;若某账号命中额度限制 60007,
平台的"异步验证任务数量已达上限"限制(错误码 60007),自动切换到下一个 跳过该账号并尝试下一账号提交当前模型。
账号继续提交同一个模型,直至全部账号额度用尽。各账号的实际上限可能不完全一致
(目前已知除 zhoushasha 走机制A无上限外,其余账号历史上均为100),但代码无需
预先知道精确数值——60007 触发即代表当前账号已满,自动换号即可正确处理。
之后保持 HTTP 服务存活,暴露 /health(K8s 探活)和 /status(运行状态)。 之后保持 HTTP 服务存活,暴露 /health(K8s 探活)和 /status(运行状态)。
""" """
@@ -22,6 +18,7 @@ import signal
import threading import threading
from datetime import datetime from datetime import datetime
from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer
from pathlib import Path
from typing import List, Tuple from typing import List, Tuple
import requests import requests
@@ -41,506 +38,54 @@ HTTP_PORT = 8080
# v1.0.18 测试确认:l112233 提交 ppu_zw_810e 全部命中 60006(该榜单保护期,仅白名单用户可提交), # v1.0.18 测试确认:l112233 提交 ppu_zw_810e 全部命中 60006(该榜单保护期,仅白名单用户可提交),
# 说明机制B(本仓库)的账号目前都不在 ppu_zw_810e 白名单里,需走 zhoushasha 机制A提交;本轮恢复多账号 fallback 轮转 # 说明机制B(本仓库)的账号目前都不在 ppu_zw_810e 白名单里,需走 zhoushasha 机制A提交;本轮恢复多账号 fallback 轮转
ACCOUNTS: List[Tuple[str, str, str]] = [ ACCOUNTS: List[Tuple[str, str, str]] = [
("zhouyuanxi", "i-zhouyuanxi@4paradigm.com", "62b9b487eff2488fb9f1da0b963f0b93"),
("zhoukaile", "zhoukaile", "bd7c52f3b9604ef48a14dd6174513935"),
("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"), ("zhangyuanxi", "zhangyuanxi", "24ed39f7f0d84fafbe0ca808e62b191c"),
("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"), ("jiajing", "jiajing", "5e051e0ff8384a81af53bea780deb28a"),
("jiangxiaowen", "jiangxiaowen", "88d5fee9f1fe4f7583f11a9d3702dc85"),
("miaoyao", "miaoyao", "77033cee0fb549598cdd590be0d02983"),
("zhao", "zhao", "421e75fb54904eb3a131d5647f299b23"),
("l112233", "l112233", "40cb6910dc9a442a816298a228da65ac"), ("l112233", "l112233", "40cb6910dc9a442a816298a228da65ac"),
("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"), ("l11223344", "l11223344", "e1c0db2959e5411f9342c8550b03f6e9"),
("keii", "keii", "be99003a85f640d8978823a5a8e3f297"),
] ]
# 本轮实际参与提交的账号(平均轮转只在这几个之间进行)。
# 留空 [] 表示使用 ACCOUNTS 里的全部账号。
# 沿用上一轮指定的 4 个活跃账号;其余 6 个保留在 ACCOUNTS 里备用。
ACTIVE_ACCOUNT_LABELS: List[str] = [
"zhangyuanxi", "jiajing", "l112233", "l11223344",
]
ACTIVE_ACCOUNTS: List[Tuple[str, str, str]] = (
[a for a in ACCOUNTS if a[0] in ACTIVE_ACCOUNT_LABELS]
if ACTIVE_ACCOUNT_LABELS else list(ACCOUNTS)
)
# ══════════════════════════════════════════════════════════ # ══════════════════════════════════════════════════════════
# 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) # 各 GPU 的模型列表
# ══════════════════════════════════════════════════════════ # ══════════════════════════════════════════════════════════
METAX_MODELS = [ MODEL_DIR = Path(__file__).resolve().parent / "model_ids"
"emrevrg/Norovox-Alpha-MoE-7.0B",
"MusePublic/stable-diffusion-xl-base",
"emrevrg/Norovox-Alpha-MoE-1.2B",
"emrevrg/Norovox-Alpha-MoE-3.9B",
"DCAgent/g1_clean_hybrid_25k_32b",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"sapidlabs/Sparkulator-GLM-5.2",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"iamsiddj/EducatorHelperModel",
"fpadovani/jpn-jpan-100mb-after-ppt-Dp-100mb-ckpt500_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"anicka/ke-v9-8b",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-10mb_seed10",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"LamNguyen0904/vistral-medical-adapter",
"Jolieb/tinyllama-lora-object-sorting",
"nessy-studio/poison-gemma",
"fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407",
"flywheel-ai/real-estate",
"famseamus/LFM2.5-DCR-8B-A1B",
"Blackfrost-AI/Lumix-4B",
"ibm-granite/granite-34b-code-base-8k",
"microsoft/Dayhoff-3b-UR90-10000",
"microsoft/Dayhoff-3b-UR90-10",
"developer-lunark/Qwen3-30B-Korean-Roleplay",
"kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo",
"trl-internal-testing/tiny-Phi3ForCausalLM-3.5",
"dfgertg/idk",
"LeVraiCNL/ornith_finetune_v3",
"yuchen-zhu-zyc/HybridDiffusion-2B",
"bardsai/finance-sentiment-zh-fast",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455",
"berkbirkan/gemma-3-lora-finetune-x-replies",
"nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"ngocnamk3er/dsi_transformers_code_t5_base_python",
"TheDrummer/Big-Tiger-Gemma-27B-v1",
"trashpanda-org/QwQ-32B-Snowdrop-v0",
"WizardLMTeam/WizardCoder-33B-V1.1",
"Tesslate/UIGEN-X-32B-0727",
"AscendKernelGen/KernelGen-LM-32B",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"ibm-granite/granite-4.1-30b-base",
"open-thoughts/OpenThinkerAgent-32B",
"zai-org/chatglm-6b",
"drbaph/s2-pro-fp8",
"Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16",
"groxaxo/s2-pro-BnB-4Bits",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"morphllm/dspark-glm52-draft",
"kanishka/opt-babylm1_no_preemption_laugh_seed-211_5e-6",
"bachvnju/qwen3-0.6b-coder",
"xpuenabler/gpt-oss-15.5b-23E-SFT",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"Pageshift-Entertainment/pagestorm-research-preview-24b-first-chapter-only",
"pki/nova-24b-cybersec",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
]
KUNLUNXIN_MODELS = [
"AI-ModelScope/granite-20b-code-base",
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4",
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16",
"AI-ModelScope/granite-20b-code-instruct-8k",
"AI-ModelScope/granite-20b-code-base-8k",
"openbmb/MiniCPM4-8B-marlin-cpmcu",
"AI-ModelScope/granite-20b-code-instruct",
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"iamsiddj/EducatorHelperModel",
"google/gemma-2b-cpp",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"anicka/ke-v9-8b",
"EBLANSoft/eblangpt-falos67",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"malaiwah/GLM-5.2-SIQ-Fruit-Instruct",
"fpadovani/eng-latn-100mb-ppt-shuff-dyck-100mb_seed10",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"fpadovani/dan-latn-10mb-after-ppt-Dp-10mb-ckpt500_seed3407",
"flywheel-ai/real-estate",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"lsm0729/Qwen2.5-VL-3B-Instruct-quantized.w8a8",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"cjos/my-awesome-setfit-model",
"litert-community/Ministral-3-3B-Reasoning-2512",
"mizzaay/6de7a1b5",
"MU-Kindai/SBERT-JSNLI-base",
"JoBeer/multi-qa-mpnet-base-dot-v1-eclass",
"pkshatech/simcse-ja-bert-base-clcmlp",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-hybrid",
"louisbetsch/new-classification-model",
"aammari/setfit-zero-shot-classification-pbsp-p3-cons",
"JoBeer/all-mpnet-base-v2-eclass",
"arithmetic-circuit-overloading/gpt2-64D-1L-4H",
"aammari/setfit-zero-shot-classification-pbsp-p3-trig",
"gart-labor/eng-distilBERT-se-eclass",
"arithmetic-circuit-overloading/gpt2-256D-1L-8H",
"gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"fawazatvetted/fine_tuned_mpnetv2",
"leerobert/my-awesome-setfit-model",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"lewtun/setfit-minilm-distilled-test",
"aparna1595/bert-mpnet-sentence",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"mssongit/fndeberta-sentence",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"aammari/setfit-zero-shot-classification-pbsp-p3-dur",
"aammari/setfit-zero-shot-classification-pbsp-p3-freq",
"dlicari/distil-ita-legal-bert",
"aammari/setfit-zero-shot-classification-pbsp-p3-bhvr",
"dlicari/sentence-ita-eurlex-bert-base",
"lsanochkin/setfit-rubert-intent",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"microsoft/VibeVoice-Realtime-0.5B",
"ShwetActhq/dummy_setfit",
"gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenVoiceOS/canary-qwen-2.5b-onnx",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"aammari/setfit-zero-shot-classification-pbsp-p1",
"meta-llama/Prompt-Guard-86M",
"kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"kornwtp/ConGen-simcse-model-roberta-base-thai",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"lmxhappy/brand_bert",
"kamalkraj/BioSimCSE-BioLinkBERT-BASE",
"lmxhappy/tiyu_bert",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8",
"futuredatascience/action-classifier-v2",
"LoneStriker/Orca-2-13b-5.0bpw-h6-exl2",
"futuredatascience/to-classifier-v2",
"futuredatascience/from-classifier-v2",
"shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30",
]
BIREN_MODELS = [ def load_model_ids(filename: str) -> List[str]:
"emrevrg/Norovox-Alpha-MoE-7.0B", model_ids = [
"emrevrg/Norovox-Alpha-MoE-1.2B", line.strip()
"emrevrg/Norovox-Alpha-MoE-3.9B", for line in (MODEL_DIR / filename).read_text(encoding="utf-8").splitlines()
"AI-ModelScope/granite-20b-code-base", if line.strip()
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4", ]
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16", if not model_ids or len(model_ids) != len(set(model_ids)):
"AI-ModelScope/granite-20b-code-instruct-8k", raise ValueError(f"模型列表为空或含重复 ID: {filename}")
"openbmb/MiniCPM4-8B-marlin-cpmcu", return model_ids
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_conj_ratio_0p25_mix_0p25_43",
"RadixArk/Qwen3.8-27B-DSpark",
"iamsiddj/EducatorHelperModel",
"google/gemma-2b-cpp",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"devika-tiwari/gpt2_small_expandedbabyLM_100M_exp3_wh_v2_ratio_1p00_mix_0p25_44",
"EBLANSoft/eblangpt-falos67",
"ilhkn/my-awesome-setfit-model",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"EleutherAI/quirky-pythia-410m-mixture",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"nomic-ai/nomic-embed-text-v2-moe",
"Jolieb/tinyllama-lora-object-sorting",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Xenova/pythia-410m-deduped",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"nessy-studio/poison-gemma",
"flywheel-ai/real-estate",
"Pacific-i64/TR-MOE-306",
"bartowski/internlm2-chat-20b-llama-old",
"farbodtavakkoli/OTel-LLM-E4B-IT",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"famseamus/LFM2.5-DCR-8B-A1B",
"narendarcodes/adaption-sec-financial-arithmetic-109b",
"narendarcodes/adaption-gpt-oss-120b-telugu-instruct",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"Blackfrost-AI/Lumix-4B",
"developer-lunark/Qwen3-30B-Korean-Roleplay",
"kshitijthakkar/loggenix-moe-0.3B-A0.1B-smolagents-v0-grpo",
"LLM-Research/Phi-4-mini-flash-reasoning",
"ib-ssm/mamba2-8b-3t-4k-hf",
"dfgertg/idk",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"riccardozaccone96/flexrank-llama3.2-1B",
"yuchen-zhu-zyc/HybridDiffusion-2B",
"fpadovani/jpn-jpan-100mb-after-ppt-shuff-dyck-10mb-ckpt500_seed455",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"cjos/my-awesome-setfit-model",
"BananaMind/BananaMind-2-Nano",
"litert-community/Ministral-3-3B-Reasoning-2512",
"livadies/Bonsai-27B-Android-Local",
"blockblockblock/Qwen2.5-0.5B-Instruct-exl3-3.0bpw",
"WizardLMTeam/WizardCoder-33B-V1.1",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"Tesslate/UIGEN-X-32B-0727",
"AscendKernelGen/KernelGen-LM-32B",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"open-thoughts/OpenThinkerAgent-32B",
"drbaph/s2-pro-fp8",
"groxaxo/s2-pro-BnB-4Bits",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"Qwen/Qwen-AgentWorld-35B-A3B",
"jinxing6609/olmo3-7b-zh-merged",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"allenai/MolmoAct-7B-D-Pretrain-0812",
"allenai/MolmoAct-7B-D-LIBERO-Object-0812",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"pki/nova-24b-cybersec",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"litert-community/gemma-3-270m-it",
"LoneStriker/Orca-2-13b-5.0bpw-h6-exl2",
]
CAMBRICON_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B", METAX_MODELS = load_model_ids("MetaX_c-500_2026-09-24.txt")
"emrevrg/Norovox-Alpha-MoE-1.2B",
"emrevrg/Norovox-Alpha-MoE-3.9B", KUNLUNXIN_MODELS = load_model_ids("Kunlunxin_p-800_2026-09-24.txt")
"AI-ModelScope/granite-20b-code-base",
"llm-jp/llm-jp-4-32b-a3b-thinking", BIREN_MODELS = load_model_ids("Biren_166m_2026-09-24.txt")
"vllm-ascend/Qwen3-32B-w8a8sc-310-vllm-tp4",
"YOYO-AI/ZYH-LLM-Qwen2.5-14B-V2", CAMBRICON_MODELS = load_model_ids("Cambricon_mlu-370-x8_2026-09-24.txt")
"DCAgent/g1_clean_hybrid_25k_32b",
"amd/gpt-oss-20b-BF16-w8a8-llmcompressor",
"KoboldAI/fairseq-dense-13B-Janeway",
"KenDual3090tiNvlink/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-W4A16",
"AI-ModelScope/granite-20b-code-instruct-8k",
"openbmb/MiniCPM4-8B-marlin-cpmcu",
"AI-ModelScope/granite-20b-code-instruct",
"openbmb/MiniCPM4-8B-marlin-Eagle-vLLM",
"CaoruiLi/DefectVideoReward",
"ConstDemi/vikhr-nemo-12b-instruct-r-awq",
"sapidlabs/Sparkulator-GLM-5.2",
"pei39/deepseek_r1_distill_qwen_7b_awq_rag",
"fpadovani/jpn-jpan-100mb-ppt-Dp-10mb_seed10",
"Zynerji/Ektome-Qwen3-VL-4Bi-PristinelyUncensored",
"Zynerji/Ektome-Qwen3-VL-2Bi-PristinelyUncensored",
"iamsiddj/EducatorHelperModel",
"vorenthiclabs/vorenthos-vision-thinking-qwq-7b",
"lodestones/gemma-7b-flax",
"google/gemma-2b-cpp",
"jinaai/jina-reranker-v3.5",
"hroth01/psais-all-MiniLM-L6-v2-20shot",
"anicka/ke-v9-8b",
"EBLANSoft/eblangpt-falos67",
"fpadovani/eng-latn-10mb-ppt-shuff-dyck-disjoint-tok_seed3407",
"ilhkn/my-awesome-setfit-model",
"Ddavidich/LOMONOSOV-ZENIT-27B-1M-INDEV",
"fpadovani/eng-latn-10mb-ppt-Dp-100mb_seed10",
"penupup/quora-distilbert-multilingual-lcqmc-sfa-hr",
"hroth/psais-paraphrase-multilingual-MiniLM-L12-v2-20shot",
"hroth/psais-LaBSE-10shot",
"TurkuNLP/web-register-classification-multilingual",
"malaiwah/GLM-5.2-SIQ-Fruit-Instruct",
"nomic-ai/nomic-embed-text-v2-moe",
"Udoba45/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-tall_thorny_boar",
"VerStella/Qwen3.8-27B-heretic-ara-W8A8-DCU",
"LamNguyen0904/vistral-medical-adapter",
"Jolieb/tinyllama-lora-object-sorting",
"ibm-granite/granite-embedding-30m-sparse",
"arshiysohrevardi/moeinGTS1.5-1.5b",
"Undi95/Mistral-11B-OmniMix",
"Xenova/pythia-410m-deduped",
"Undi95/Mistral-11B-CC-Air",
"Q1ngMang/LFM2.5-350M-PT-zh_CN",
"nessy-studio/poison-gemma",
"Undi95/Mistral-11B-Airoboros-v0.1",
"flywheel-ai/real-estate",
"hroth/psais-all-MiniLM-L6-v2-1shot",
"stjiris/bert-large-portuguese-cased-legal-tsdae",
"bartowski/deepseek-llm-7b-base-exl2",
"llm-semantic-router/mmbert-fact-check-merged",
"LeVraiCNL/ornith_finetune_v3",
"fawazatvetted/fine_tuned_mpnetv3",
"berkbirkan/gemma-3-lora-finetune-x-replies",
"nm-testing/Qwen3-4B-mixed-quant-RTN-wNaM-a4",
"infgrad/Prism-Qwen3.5-Reranker-0.8B",
"cjos/my-awesome-setfit-model",
"OpenMed/OpenMed-PII-French-BioClinicalBERT-Base-110M-v1",
"seerware/granite-embedding-30m-sparse",
"MU-Kindai/SBERT-JSNLI-base",
"OpenMed/OpenMed-PII-French-BiomedELECTRA-Large-335M-v1",
"JoBeer/multi-qa-mpnet-base-dot-v1-eclass",
"OpenMed/OpenMed-PII-French-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-French-BiomedBERT-Large-340M-v1",
"infgrad/Prism-Qwen3.5-Reranker-4B",
"pkshatech/simcse-ja-bert-base-clcmlp",
"RCouronnePEReN/gpt2_finetuned_overfit-10epochs-128tokens",
"q-future/Q-ReAlign-Pro-9B",
"vrfai/gemma-4-12B-it-fp8",
"amd/Phi-4-mini-instruct-onnx-ryzenai-hybrid",
"OpenMed/OpenMed-PII-German-BioClinicalBERT-Base-110M-v1",
"louisbetsch/new-classification-model",
"Trendyol/Trendyol-LLM-Asure-12B",
"OpenMed/OpenMed-PII-German-BiomedELECTRA-Large-335M-v1",
"OpenMed/OpenMed-PII-German-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-German-BiomedBERT-Base-110M-v1",
"aammari/setfit-zero-shot-classification-pbsp-p3-cons",
"JoBeer/all-mpnet-base-v2-eclass",
"BalaRajesh1/mmbert-small-nli",
"aammari/setfit-zero-shot-classification-pbsp-p3-trig",
"charlie-li/Qwen3-Coder-30B-A3B-Instruct-Lora-ScaleSWE-Distilled-v1",
"quanda-bench-test/gpt2-small-trex-openwebtext-hf",
"quanda-bench-test/gpt2-small-trex-hf",
"quanda-bench-test/gpt2-small-trex-wikitext-ft-hf",
"quanda-bench-test/gpt2-small-trex-wikitext-hf",
"quanda-bench-test/gpt2-small-trex-openwebtext-ft-hf",
"quanda-bench-test/gpt2-small-trex-ft-hf",
"gart-labor/eng-distilBERT-se-eclass",
"Pakorn2112/Orpheus-TTS-hmong-3b",
"OpenMed/OpenMed-PII-Italian-BiomedBERT-Base-110M-v1",
"OpenMed/OpenMed-PII-Italian-BioClinicalBERT-Base-110M-v1",
"gemasphi/f-real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Large-335M-v1",
"ans2004/aragpt2-transport-autocomplete",
"fawazatvetted/fine_tuned_mpnetv2",
"Auparima/thaifood-embed",
"OpenMed/OpenMed-PII-Italian-BiomedBERT-Large-340M-v1",
"OpenMed/OpenMed-PII-Italian-BiomedELECTRA-Base-110M-v1",
"fishaudio/s2-pro",
"drbaph/s2-pro-fp8",
"leerobert/my-awesome-setfit-model",
"OpenMed/OpenMed-PII-Spanish-BioClinicalBERT-Base-110M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedELECTRA-Base-110M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedBERT-Large-340M-v1",
"OpenMed/OpenMed-PII-Spanish-BiomedBERT-Base-110M-v1",
"groxaxo/s2-pro-BnB-4Bits",
"ReconOut/granite-embedding-english-r2",
"Imagilux/fishaudio-s2-pro",
"TomoroAI/tomoro-ai-colqwen3-embed-8b-awq",
"TomoroAI/tomoro-ai-colqwen3-embed-4b-awq",
"aleada/Phi-4-mini-instruct-W4A16",
"aleada/Phi-4-W4A16",
"lewtun/setfit-minilm-distilled-test",
"morphllm/dspark-glm52-draft",
"tomaarsen/jina-embeddings-v3-hf",
"ibm-granite/granite-embedding-311m-multilingual-r2",
"aparna1595/bert-mpnet-sentence",
"ibm-granite/granite-embedding-97m-multilingual-r2",
"FINAL-Bench/Darwin-TTS-1.7B-Cross",
"amd/Phi-4-mini-reasoning-onnx-ryzenai-hybrid",
"jinaai/jina-embeddings-v3-hf",
"gluschenko/omnivoice-onnx",
"mssongit/fndeberta-sentence",
"splendor1811/omnivoice-vietnamese",
"amd/Phi-3.5-mini-instruct-onnx-ryzenai-npu",
"yugeshkarunamurthy/Ornith-1.0-9B-oQe6",
"amd/Phi-3-mini-4k-instruct-onnx-ryzenai-hybrid",
"yugeshkarunamurthy/Ornith-1.0-9B-oQe3.5",
"aammari/setfit-zero-shot-classification-pbsp-p3-dur",
"aammari/setfit-zero-shot-classification-pbsp-p3-freq",
"dlicari/distil-ita-legal-bert",
"maya-multimodal/Qwen3.5-9B-aerialsim-rl-step100",
"aammari/setfit-zero-shot-classification-pbsp-p3-bhvr",
"dlicari/sentence-ita-eurlex-bert-base",
"lsanochkin/setfit-rubert-intent",
"cyber-pal-security/CyberPal2.0-20B",
"LeaderboardModel1/grug-27b-AutoRound-W4A16-Tuning",
"microsoft/VibeVoice-Realtime-0.5B",
"Qwen/Qwen-AgentWorld-35B-A3B",
"ShwetActhq/dummy_setfit",
"gemasphi/real-setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"OpenVoiceOS/canary-qwen-2.5b-onnx",
"nvidia/nemotron-labs-audio-visual-flamingo-hf",
"LeaderboardModel1/Qwythos-9B-Claude-Mythos-5-1M-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwevolution-V0-27B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Qwen3.6-35B-A3B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Qwen3.5-4B-AutoRound-W4A16-RTN",
"YeungNLP/firefly-baichuan-7b-qlora-sft",
"LeaderboardModel1/Qwen-AgentWorld-35B-A3B-AutoRound-W4A16-RTN",
"LeaderboardModel1/Ornith-1.0-35B-AutoRound-W4A16-Tuning",
"LeaderboardModel1/Code-Writer-V2-Obliterated-BF16-AutoRound-W4A16-RTN",
"salihfurkaan/Qwen2.5-VL-ScienceQA-Math-CoT-Merged",
"LeaderboardModel1/Agents-A1-AutoRound-W4A16-RTN",
"aammari/setfit-zero-shot-classification-pbsp-p1",
"meta-llama/Prompt-Guard-86M",
"Qwen/WebWorld-32B",
"24B-Suite/Mergedonia-PROMETHEUS-24B-v1",
"kornwtp/ConGen-paraphrase-multilingual-mpnet-base-v2",
"zjiayu064/Qwen3-Next-80B-A3B-Instruct-BitsMoE-2bit",
"kornwtp/ConGen-simcse-model-roberta-base-thai",
"praxisresearch/hf_olmo_32b_em_finrisk_1",
"EleutherAI/pythia-1.4b-addition-first-ft",
"gemasphi/setfit-ss-paraphrase-multilingual-mpnet-base-v2",
"RESMP-DEV/jina-code-embeddings-1.5b-mxfp4-block-gptq",
"praxisresearch/hf_olmo_32b_em_finrisk_0",
"praxisresearch/hf_olmo_32b_em_badmed_1",
"praxisresearch/hf_olmo_32b_em_badmed_0",
"allenai/MolmoAct-7B-D-Pretrain-0812",
"allenai/MolmoAct-7B-D-LIBERO-Spatial-0812",
"allenai/MolmoAct-7B-D-LIBERO-Object-0812",
"lmxhappy/brand_bert",
"kamalkraj/BioSimCSE-BioLinkBERT-BASE",
"Mohamed-Sami-Ghrab/moove-qwen3-32b-medical-sft-v2",
"lmxhappy/tiyu_bert",
"ReadyArt/Omega-Darker-Gaslight_The-Final-Forgotten-Fever-Dream-24B",
"shrinivasbjoshi/r3-w266-setfit-mbti-noempath-multiclass-hypsearch-mpnet-dec1",
"Kwai-AutoSQL/Kwai-AutoSQL-32B",
"ibaucells/paraphrase-multilingual-mpnet-base-v2_tecla_label2_8",
"futuredatascience/action-classifier-v2",
"futuredatascience/to-classifier-v2",
"futuredatascience/from-classifier-v2",
"shrinivasbjoshi/r2-w266-setfit-mbti-multiclass-hypsearch-mpnet-nov30",
]
HYGON_MODELS = [ HYGON_MODELS = [
"emrevrg/Norovox-Alpha-MoE-7.0B", "emrevrg/Norovox-Alpha-MoE-7.0B",
@@ -2001,25 +1546,14 @@ PPU_MODELS = [
"espressovi/BODHI-qwen-3-maze-8b-distil", "espressovi/BODHI-qwen-3-maze-8b-distil",
] ]
# 本轮提交「放宽口径」的筛选结果:MetaX_c-500(89) / Kunlunxin_p-800(104) / # 本轮使用 2026-09-24 已成功下载、非量化、目标卡无验证记录,
# hygon_k100-ai(811) / Cambricon_mlu-370-x8(188) / Iluvatar_bi-150(75) / # 且其他卡至少一张「已验证」的模型:Biren(6)、Cambricon(179)、
# Biren_166m(99),共 1366 个。 # Kunlunxin(180)、MetaX(40),共 405 个 GPU/模型任务。
# # PPU 和 Hygon 已由 zhoushasha 策略提交,本轮不重复提交。
# 筛选条件②从「别的卡已验证」放宽为「别的卡已验证 或 验证中」:
# 正在验证说明模型已通过平台基本检查(格式/唯一性),只是还没出结果。
# 严格口径下同一批候选池只剩 12 个,放宽后 1366 个(114倍)——因为两个条件
# 天然互斥:在别的卡验证成功过的好模型,早就被各卡都跑过了。
#
# 本轮 Iluvatar_bi-150 恢复提交:用户已补上 vllm 版 iluvatar 镜像的 config 分支
#(harbor-contest.4pd.io/luopingyi/enginex-iluvatar-bi150/vllm:0.8.3)。
# 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/
# Sunrise_pt-200-x1(v1.0.13已完成)
GPU_JOBS: List[Tuple[str, List[str]]] = [ GPU_JOBS: List[Tuple[str, List[str]]] = [
("MetaX_c-500", METAX_MODELS), ("MetaX_c-500", METAX_MODELS),
("Kunlunxin_p-800", KUNLUNXIN_MODELS), ("Kunlunxin_p-800", KUNLUNXIN_MODELS),
("hygon_k100-ai", HYGON_MODELS),
("Cambricon_mlu-370-x8", CAMBRICON_MODELS), ("Cambricon_mlu-370-x8", CAMBRICON_MODELS),
("Iluvatar_bi-150", ILUVATAR_BI150_MODELS),
("Biren_166m", BIREN_MODELS), ("Biren_166m", BIREN_MODELS),
] ]
TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS) TOTAL_MODELS = sum(len(models) for _, models in GPU_JOBS)
@@ -2035,8 +1569,9 @@ _state = {
"total": TOTAL_MODELS, "total": TOTAL_MODELS,
"submitted": 0, "submitted": 0,
"failed": 0, "failed": 0,
"per_account": {label: 0 for label, _, _ in ACCOUNTS}, "per_account": {label: 0 for label, _, _ in ACTIVE_ACCOUNTS},
"current_account": ACCOUNTS[0][0], "per_gpu": {gpu: 0 for gpu, _ in GPU_JOBS},
"current_account": ACTIVE_ACCOUNTS[0][0],
"started_at": None, "started_at": None,
"finished_at": None, "finished_at": None,
} }
@@ -2358,17 +1893,17 @@ def _run_worker():
if _shutdown.is_set(): if _shutdown.is_set():
break break
if len(exhausted) >= len(ACCOUNTS): if len(exhausted) >= len(ACTIVE_ACCOUNTS):
print(f"⏭️ 所有账号额度已用尽,跳过: {model_id} ({gpu_type})", flush=True) print(f"⏭️ 所有账号额度已用尽,跳过: {model_id} ({gpu_type})", flush=True)
_state["failed"] += 1 _state["failed"] += 1
continue continue
submitted_ok = False submitted_ok = False
# 从当前轮转位置起,最多把 4 个账号各试一遍 # 从当前轮转位置起,最多把 4 个账号各试一遍
for _ in range(len(ACCOUNTS)): for _ in range(len(ACTIVE_ACCOUNTS)):
idx = rr % len(ACCOUNTS) idx = rr % len(ACTIVE_ACCOUNTS)
rr += 1 rr += 1
label, _account, token = ACCOUNTS[idx] label, _account, token = ACTIVE_ACCOUNTS[idx]
if label in exhausted: if label in exhausted:
continue continue
_state["current_account"] = label _state["current_account"] = label
@@ -2381,7 +1916,7 @@ def _run_worker():
break break
elif code == 60007: elif code == 60007:
exhausted.add(label) exhausted.add(label)
print(f"⛔ 账号 [{label}] 提交额度已满,本轮不再使用(已满 {len(exhausted)}/{len(ACCOUNTS)})", flush=True) print(f"⛔ 账号 [{label}] 提交额度已满,本轮不再使用(已满 {len(exhausted)}/{len(ACTIVE_ACCOUNTS)})", flush=True)
continue continue
else: else:
# 模型自身问题(重复提交/唯一性等),换账号也没用,直接跳过 # 模型自身问题(重复提交/唯一性等),换账号也没用,直接跳过
@@ -2390,6 +1925,7 @@ def _run_worker():
if submitted_ok: if submitted_ok:
_state["submitted"] += 1 _state["submitted"] += 1
_state["per_gpu"][gpu_type] += 1
successful.append(f"{gpu_type}\t{model_id}") successful.append(f"{gpu_type}\t{model_id}")
else: else:
_state["failed"] += 1 _state["failed"] += 1
@@ -2405,7 +1941,8 @@ def _run_worker():
_state["phase"] = "done" _state["phase"] = "done"
print( print(
f"[worker] 完成 submitted={_state['submitted']} failed={_state['failed']} " f"[worker] 完成 submitted={_state['submitted']} failed={_state['failed']} "
f"total={_state['total']} per_account={_state['per_account']}", f"total={_state['total']} per_account={_state['per_account']} "
f"per_gpu={_state['per_gpu']}",
flush=True, flush=True,
) )
# 提交完成后继续保持进程存活,等待平台停止 # 提交完成后继续保持进程存活,等待平台停止

View File

@@ -0,0 +1,6 @@
kaividlabs/qwen3-4b-awq
quyetdev/qwen3_8B_v3_fine_tuned_awq
zerofata/MS3.2-PaintedFantasy-v3-24B
ibm-granite/granite-4.1-30b
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
waltonfuture/qwen2.5vl-3b-32b-longest-5153

View File

@@ -0,0 +1,179 @@
kaividlabs/qwen3-4b-awq
glins7/cashgo-role_classification
futuredatascience/from-classifier-v1
kowshik/upsc-classification-model-v1
lewispons/large-email-classifier
YouLiXiya/tinyllava-v1.0-1.1b-hf
javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final
Vishwas/intent_classification
mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection
kornwtp/ConGen-RoBERTa-base
kornwtp/ConGen-BERT-Small
kornwtp/ConGen-TinyBERT-L4
kornwtp/ConGen-BERT-Mini
kornwtp/ConGen-BERT-Tiny
TingChenChang/cMedQA2-multi-qa-mpnet-zh
dvilasuero/my-test-setfit
mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR
jamescalam/mpnet-nli-sts
jamescalam/mpnet-snli-negatives
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness
firqaaa/indo-sentence-bert-base
income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b
ceggian/sbert_standard_reddit_mnr
DMetaSoul/sbert-chinese-qmc-domain-v1-distill
sentence-transformers/msmarco-distilbert-base-v4
DMetaSoul/sbert-chinese-qmc-domain-v1
mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04
whaleloops/phrase-bert
valurank/paraphrase-mpnet-base-v2-offensive
usc-isi/sbert-roberta-large-anli-mnli-snli
uer/sbert-base-chinese-nli
symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli
symanto/sn-mpnet-base-snli-mnli
sentence-transformers/xlm-r-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-bert-base-nli-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens
sentence-transformers/stsb-roberta-large
sentence-transformers/stsb-roberta-base
sentence-transformers/stsb-roberta-base-v2
sentence-transformers/stsb-distilroberta-base-v2
sentence-transformers/stsb-distilbert-base
sentence-transformers/sentence-t5-xxl
sentence-transformers/sentence-t5-xl
sentence-transformers/sentence-t5-base
sentence-transformers/roberta-large-nli-stsb-mean-tokens
sentence-transformers/roberta-large-nli-mean-tokens
sentence-transformers/roberta-base-nli-mean-tokens
sentence-transformers/quora-distilbert-base
sentence-transformers/paraphrase-distilroberta-base-v2
sentence-transformers/paraphrase-distilroberta-base-v1
sentence-transformers/paraphrase-albert-small-v2
sentence-transformers/paraphrase-albert-base-v2
sentence-transformers/paraphrase-TinyBERT-L6-v2
sentence-transformers/nli-roberta-large
sentence-transformers/nli-roberta-base
sentence-transformers/nli-roberta-base-v2
sentence-transformers/nli-distilroberta-base-v2
iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online
iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online
iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online
iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch
iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online
sentence-transformers/nli-distilbert-base
sentence-transformers/nli-bert-large
sentence-transformers/gtr-t5-xxl
sentence-transformers/gtr-t5-xl
dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch
sentence-transformers/nli-bert-large-cls-pooling
Mozilla/llava-v1.5-7b-llamafile
MathLLMs/MathCoder-VL-2B
Mantis-VL/llava_siglip_llama3_8b_finetune_8192
sentence-transformers/nli-bert-base-cls-pooling
sentence-transformers/multi-qa-distilbert-dot-v1
sentence-transformers/multi-qa-distilbert-cos-v1
sentence-transformers/msmarco-distilbert-dot-v5
sentence-transformers/msmarco-distilbert-cos-v5
sentence-transformers/msmarco-distilbert-base-v2
sentence-transformers/msmarco-distilbert-base-dot-prod-v3
sentence-transformers/msmarco-bert-co-condensor
sentence-transformers/msmarco-bert-base-dot-v5
ydyajyA/Llama-2-13b-hf
sentence-transformers/gtr-t5-large
q2792046875/internVL1B
muse/openai-clip-vit-large-patch14
sentence-transformers/gtr-t5-base
sentence-transformers/facebook-dpr-question_encoder-single-nq-base
sentence-transformers/facebook-dpr-question_encoder-multiset-base
sentence-transformers/distilbert-base-nli-stsb-quora-ranking
llava-hf/llava-v1.6-vicuna-7b-hf
sentence-transformers/facebook-dpr-ctx_encoder-multiset-base
jinaai/jina-embeddings-v3
sentence-transformers/distilroberta-base-msmarco-v1
sentence-transformers/distilroberta-base-msmarco-v2
sentence-transformers/distilbert-base-nli-mean-tokens
Vchitect/ShotVL-3B
Qwen/Qwen3-VL-2B-Thinking
OpenGVLab/VideoChat-R1_7B
yasserrmd/deepseek-esg-assistant
Bingdo/dcug_pdf_mixtral_nemo_base_12b
unsloth/gemma-3-4b-it
unsloth/gemma-3-12b-it
theprint/phi-3-mini-4k-gamedev
simonlesaumon/Mistral-NeMo-12B-Unslopper-FR-v1
reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled
starVLA/Qwen3-VL-4B-Instruct-Action
mistralai/Pixtral-12B-2409
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP
DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full
waltonfuture/qwen2.5vl-3b-aha-7b-distilled
mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3
waltonfuture/qwen2.5vl-3b-best
jeremyhola/LORAs
osanseviero/clip-st
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
new5558/simcse-model-wangchanberta-base-att-spm-uncased
navteca/multi-qa-mpnet-base-cos-v1
navteca/all-mpnet-base-v2
nanopass/test-model-fe
mrp/simcse-model-m-bert-thai-cased
mrm8488/roberta-base-bne-finetuned-sqac-retriever
laion/openthoughts-4-code-qwen3-32b-annotated-32k_qwen3-1.7B_32k
OpenGVLab/InternVL3-1B-Instruct
OpenGVLab/InternVL2_5-8B-MPO
OpenGVLab/InternVL2_5-2B-MPO
OpenGVLab/InternVL2_5-2B
sakares/wav2vec2-large-xlsr-thai-demo
cahya/wav2vec2-large-xlsr-indonesian
indonesian-nlp/wav2vec2-large-xlsr-indonesian-baseline
indonesian-nlp/wav2vec2-large-xlsr-indonesian
m3hrdadfi/wav2vec2-large-xlsr-persian-v3
nguyenvulebinh/wav2vec2-base-vietnamese-250h
airesearch/wav2vec2-large-xlsr-53-th
indonesian-nlp/wav2vec2-indonesian-javanese-sundanese
ctl/wav2vec2-large-xlsr-cantonese
jonatasgrosman/wav2vec2-large-xlsr-53-persian
jonatasgrosman/wav2vec2-large-xlsr-53-arabic
muzamil47/wav2vec2-large-xlsr-53-arabic-demo
prithivMLmods/Qwen2-VL-OCR-2B-Instruct
waltonfuture/qwen2.5vl-3b-sampled_10000_qwen2.5vl_sc
waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b
MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ
waltonfuture/qwen2.5vl-3b-rl-sft
waltonfuture/qwen2.5vl-3b-sampled_10000_reflection-cot-7b
waltonfuture/qwen2.5vl-3b-32b_shuffle
waltonfuture/qwen2.5vl-3b-caption-cot-7b
waltonfuture/qwen2.5vl-3b-32b-longest-5153
waltonfuture/qwen2.5vl-3b-self-critic-cot
waltonfuture/qwen2.5vl-3b-sampled_10000_mixed-reflection-cot-32b
waltonfuture/qwen2.5vl-3b-sampled_15000_reflection-cot-32b
kresnik/wav2vec2-large-xlsr-korean
mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1
zhaokaikai/Qwen2.5-VL-3B-Instruct-Traffic
waltonfuture/qwen2.5vl-3b-32b-longest-25767
waltonfuture/qwen2.5vl-3b-32b-wrong-response
waltonfuture/qwen2.5vl-3b-sampled_all_qwen2.5vl32b
OpenMed/Qwen2.5-3B-MedVL
maxidl/wav2vec2-large-xlsr-german
imvladikon/wav2vec2-xls-r-300m-hebrew
dbdmg/wav2vec2-xls-r-300m-italian-robust
mikr/whisper-large-v3-czech-cv13
prithivMLmods/ChemQwen-vL
ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0
jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA
whitefox123/w2v-bert-2.0-arabic-4
Finnish-NLP/wav2vec2-xlsr-1b-finnish-lm-v2
01ai/Yi-VL-6B
AI-ModelScope/bert-base-uncased
Qwen/Qwen3-VL-4B-Instruct
Bidwill/whisper-small-sanskrit
Baraa123R/whisper-finetuned-TheArabMaghreb2
Apel-sin/whisper-large-v3-russian-ties-podlodka-v1.2
Finnish-NLP/wav2vec2-xlsr-300m-finnish-lm
GetmanY1/wav2vec2-large-fi-150k-finetuned
groxaxo/octen-embedding-8b-w4a16
unsloth/orpheus-3b-0.1-ft
cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged
ayoubkirouane/whisper-small-ar

View File

@@ -0,0 +1,180 @@
glins7/cashgo-role_classification
futuredatascience/from-classifier-v1
kowshik/upsc-classification-model-v1
YouLiXiya/tinyllava-v1.0-1.1b-hf
javiervela/sentence-transformers_distiluse-base-multilingual-cased-v2_50-50_all-v2_sequence_oaei_final
Vishwas/intent_classification
airnicco8/xlm-roberta-en-it-de
tubyneto/wandss-bert
nategro/nps-mpnet-lds
mrm8488/setfit-mpnet-base-v2-finetuned-spam-detection
kornwtp/ConGen-RoBERTa-base
kornwtp/ConGen-TinyBERT-L6
kornwtp/ConGen-BERT-Small
kornwtp/ConGen-TinyBERT-L4
kornwtp/ConGen-BERT-Tiny
TingChenChang/hpv-multi-qa-mpnet-zh
Charul/my-dummy-model-1
TingChenChang/cMedQA2-multi-qa-mpnet-zh
dvilasuero/my-test-setfit
dvilasuero/setfit-mini-imdb
mrm8488/setfit-mpnet-base-v2-finetuned-sentEval-CR
bongsoo/moco-sentencedistilbertV2.1
jamescalam/mpnet-nli-sts
TingChenChang/hpvqa-lcqmc-ocnli-cnsd-multi-MiniLM-v2
TingChenChang/lcqmc-ocnli-cnsd-multi-MiniLM-v2
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_data_coverage
valhalla/distilbart-mnli-12-9
teven/cross_all-mpnet-base-v2_finetuned_WebNLG2020_correctness
jamescalam/mpnet-qa
jamescalam/deberta-v3-base-qa
firqaaa/indo-sentence-bert-base
bongsoo/moco-sentencebertV2.0
smartmind/roberta-ko-small-tsdae
aiknowyou/all-mpnet-base-questions-clustering-en
lewtun/dummy-setfit-model
TingChenChang/qqp-nli-training-paraphrase-multilingual-MiniLM-L12-v2
bongsoo/moco-sentencedistilbertV2.0
edumunozsala/bertin-sts-cc-news-es
smartmind/ko-sbert-augSTS-maxlength512
spacemanidol/esci-es-mpnet-crossencoder
spacemanidol/esci-mpnet-crossencoder
embedding-data/distilroberta-base-sentence-transformer
sdadas/st-polish-paraphrase-from-mpnet
sorayutmild/simcse-model-wangchanberta-finetuned-sanook-news
aiknowyou/aiky-sentence-bertino
NimaBoscarino/STPushToHub-test
alfaneo/bertimbaulaw-base-portuguese-sts
WalidLak/Testmodel
shafin/distilbert-similarity-b32-3
guidecare/all-mpnet-base-v2-feature-extraction
income/bpr-gpl-climate-fever-base-msmarco-distilbert-tas-b
income/bpr-gpl-hotpotqa-base-msmarco-distilbert-tas-b
income/bpr-gpl-nfcorpus-base-msmarco-distilbert-tas-b
income/bpr-gpl-scifact-base-msmarco-distilbert-tas-b
income/bpr-gpl-webis-touche2020-base-msmarco-distilbert-tas-b
ITESM/sentece-embeddings-BETO
espejelomar/sentece-embeddings-BETO
ceggian/sbert_pt_reddit_mnr_128
ceggian/sbert_pt_reddit_softmax_512
GPL/bioasq-msmarco-distilbert-gpl
GPL/nfcorpus-tsdae-msmarco-distilbert-gpl
GPL/dbpedia-entity-tsdae-msmarco-distilbert-gpl
GPL/quora-distilbert-tas-b-gpl-self_miner
ceggian/sbert_standard_reddit_mnr
snunlp/KR-SBERT-V40K-klueNLI-augSTS
GPL/trec-news-tsdae-msmarco-distilbert-gpl
GPL/fever-tsdae-msmarco-distilbert-gpl
GPL/dbpedia-entity-msmarco-distilbert-gpl
mrp/SimCSE-model-WangchanBERTa-V2
GPL/scifact-distilbert-tas-b-gpl-self_miner
sentence-transformers/stsb-bert-large
sentence-transformers/stsb-bert-base
sentence-transformers/sentence-t5-large
sentence-transformers/quora-distilbert-multilingual
GPL/arguana-tsdae-msmarco-distilbert-gpl
GPL/trec-covid-msmarco-distilbert-gpl
GPL/webis-touche2020-msmarco-distilbert-gpl
GPL/trec-news-msmarco-distilbert-gpl
GPL/nq-msmarco-distilbert-gpl
GPL/climate-fever-msmarco-distilbert-gpl
GPL/newsqa-msmarco-distilbert-gpl
ddobokki/unsup-simcse-klue-roberta-small
GPL/arguana-msmarco-distilbert-gpl
sentence-transformers/use-cmlm-multilingual
bespin-global/klue-sroberta-base-continue-learning-by-mnr
somosnlp-hackathon-2022/paraphrase-spanish-distilroberta
somosnlp-hackathon-2022/bertin-roberta-base-finetuning-esnli
sentence-transformers/xlm-r-base-en-ko-nli-ststb
sentence-transformers/multi-qa-mpnet-base-dot-v1
sentence-transformers/msmarco-distilbert-base-v4
morethankk/ThermalGuard-v1_4
DMetaSoul/sbert-chinese-dtm-domain-v1
moshew/paraphrase-mpnet-base-v2_SetFit_sst2
mariolux/sherpa-onnx-whisper-tiny
mariolux/sherpa-onnx-whisper-small
mariolux/sherpa-onnx-telespeech-ctc-zh-2024-06-04
whaleloops/phrase-bert
mariolux/sherpa-onnx-fire-red-asr-large-zh_en-2025-02-16
longvideotool/LongVT-SFT
valurank/paraphrase-mpnet-base-v2-offensive
symanto/sn-xlm-roberta-base-snli-mnli-anli-xnli
sentence-transformers/xlm-r-bert-base-nli-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-stsb-mean-tokens
sentence-transformers/xlm-r-100langs-bert-base-nli-mean-tokens
sentence-transformers/stsb-xlm-r-multilingual
sentence-transformers/stsb-roberta-base
sentence-transformers/stsb-roberta-base-v2
sentence-transformers/stsb-mpnet-base-v2
sentence-transformers/stsb-distilroberta-base-v2
sentence-transformers/stsb-distilbert-base
sentence-transformers/sentence-t5-xxl
sentence-transformers/roberta-large-nli-stsb-mean-tokens
sentence-transformers/roberta-large-nli-mean-tokens
sentence-transformers/roberta-base-nli-stsb-mean-tokens
sentence-transformers/roberta-base-nli-mean-tokens
sentence-transformers/quora-distilbert-base
sentence-transformers/paraphrase-xlm-r-multilingual-v1
sentence-transformers/paraphrase-mpnet-base-v2
sentence-transformers/paraphrase-distilroberta-base-v1
sentence-transformers/paraphrase-albert-small-v2
sentence-transformers/paraphrase-MiniLM-L3-v2
sentence-transformers/paraphrase-MiniLM-L12-v2
sentence-transformers/nli-roberta-large
sentence-transformers/nli-roberta-base
sentence-transformers/nli-roberta-base-v2
sentence-transformers/nli-mpnet-base-v2
sentence-transformers/nli-distilroberta-base-v2
iic/speech_conformer_asr_nat-zh-cn-16k-aishell1-vocab4234-pytorch
iic/speech_UniASR_asr_2pass-zh-cn-16k-common-vocab8358-tensorflow1-online
iic/speech_UniASR_asr_2pass-ru-16k-common-vocab1664-tensorflow1-online
iic/speech_UniASR_asr_2pass-id-16k-common-vocab1067-tensorflow1-online
iic/speech_UniASR_asr_2pass-he-16k-common-vocab1085-pytorch
iic/speech_UniASR_asr_2pass-en-16k-common-vocab1080-tensorflow1-online
iic/speech_UniASR_asr_2pass-cantonese-CHS-16k-common-vocab1468-tensorflow1-online
sentence-transformers/nli-distilbert-base
sentence-transformers/nli-bert-large
sentence-transformers/multi-qa-mpnet-base-cos-v1
sentence-transformers/gtr-t5-xxl
sentence-transformers/gtr-t5-xl
dengcunqin/speech_seaco_paraformer_large_asr_nat-zh-cantonese-en-16k-common-vocab11666-pytorch
Mozilla/llava-v1.5-7b-llamafile
sentence-transformers/multi-qa-MiniLM-L6-dot-v1
Deeps03/qwen2-1.5b-log-classifier
sentence-transformers/msmarco-distilbert-cos-v5
sentence-transformers/msmarco-distilbert-base-v2
sentence-transformers/msmarco-distilbert-base-dot-prod-v3
sentence-transformers/msmarco-bert-base-dot-v5
sentence-transformers/msmarco-MiniLM-L6-v3
sentence-transformers/msmarco-MiniLM-L12-v3
sentence-transformers/gtr-t5-large
q2792046875/internVL1B
muse/openai-clip-vit-large-patch14
sentence-transformers/gtr-t5-base
sentence-transformers/facebook-dpr-question_encoder-single-nq-base
sentence-transformers/facebook-dpr-question_encoder-multiset-base
sentence-transformers/distilbert-base-nli-stsb-quora-ranking
Vchitect/ShotVL-3B
Bingdo/dcug_pdf_mixtral_nemo_base_12b
unsloth/gemma-3-4b-it
unsloth/gemma-3-12b-it
reedmayhew/gemma3-12B-claude-3.7-sonnet-reasoning-distilled
starVLA/Qwen3-VL-4B-Instruct-Action
mistralai/Pixtral-12B-2409
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_qwen7b_easy_gta17b_or_segui3b-4MP
mlfoundations-cua-dev/qwen2_5vl_7b_easyr1_10k_hard_segui3b_easy_gta1-4MP
DaDing777/qwen2.5-VL-3B-atm-finetune-cot-full
mlfoundations-cua-dev/qwen2_5vl_3b_sft_idm_how_to_onannel_agent_sft_data_local_bs_4_epochs_3
osanseviero/clip-st
HuggingFaceTB/SmolLM2-ablation-ultrachat-v2
new5558/simcse-model-wangchanberta-base-att-spm-uncased
navteca/multi-qa-mpnet-base-cos-v1
navteca/all-mpnet-base-v2
NaClNeZn/Qwen3-1.7B-QLoRA-Shizuku-v1
waltonfuture/qwen2.5vl-3b-sampled_5000_qwen2.5vl32b
MBZUAI/Qwen-2.5-VL-Instruct-3B-Pointwise-DFJ
waltonfuture/qwen2.5vl-3b-32b-longest-5153
mlfoundations-cua-dev/qwen2_5vl_3b_sft_unified_idm_data_with_new_idm_data_2_frames_local_bs_1
ocordeiro/w2v-bert-2.0-portuguese-colab-CV16.0
whitefox123/w2v-bert-2.0-arabic-4
unsloth/orpheus-3b-0.1-ft

View File

@@ -0,0 +1,40 @@
rewfueranro/Mechanical_lora
PaperCloud/zju19_minguo_style_lora
wangzai/autumn_bg_style_lora
kaividlabs/qwen3-4b-awq
zerofata/MS3.2-PaintedFantasy-v3-24B
AI-ModelScope/Qwen2vl-Flux
NastasiaM/mbert-loraxs-qa-vanilla
muse/flux1-redux-dev
muse/flux1-canny-dev-lora
iic/multi-modal_chinese_stable_diffusion_v1.0
iic/cv_diffusion_text-to-image-synthesis_tiny
iic/cv_cartoon_stable_diffusion_illustration
amd/stable-diffusion-1.5_io32_amdgpu
MusePublic/89_lora_SD_XL
MAILAND/loco-flux-2.5
EnlZhao/deer_lora
AI-ModelScope/t2iadapter_zoedepth_sd15v1
AI-ModelScope/t2iadapter_sketch_sd15v2
AI-ModelScope/t2iadapter_seg_sd14v1
AI-ModelScope/t2iadapter_depth_sd14v1
AI-ModelScope/t2iadapter_canny_sd15v2
AI-ModelScope/t2iadapter_canny_sd14v1
AI-ModelScope/t2i-adapter-sketch-sdxl-1.0
AI-ModelScope/t2i-adapter-openpose-sdxl-1.0
AI-ModelScope/t2i-adapter-lineart-sdxl-1.0
AI-ModelScope/t2i-adapter-depth-midas-sdxl-1.0
AI-ModelScope/t2i-adapter-canny-sdxl-1.0
AI-ModelScope/sdxl-vae-fp16-fix
AI-ModelScope/controlnet-depth-sdxl-1.0-small
AI-ModelScope/controlnet-depth-sdxl-1.0-mid
AI-ModelScope/controlnet-canny-sdxl-1.0-small
stabilityai/stable-diffusion-3-medium_amdgpu
stabilityai/stable-diffusion-2-1-base
AI-ModelScope/t2iadapter_keypose_sd14v1
AI-ModelScope/controlnet-union-sdxl-1.0-promax
ibm-granite/granite-4.1-30b
waltonfuture/qwen2.5vl-3b-32b-longest-5153
jyyyyy67/Llama3.1-8B_weak-minded_Bar_LoRA
AI-ModelScope/controlnet-canny-sdxl-1.0
cvis-tmu/qwen2_5vl-7b-lora-sft-Scene30k_traineval_426steps_merged