diff --git a/main.py b/main.py index 569024a..fe992e1 100644 --- a/main.py +++ b/main.py @@ -58,129 +58,745 @@ ACCOUNTS: List[Tuple[str, str, str]] = [ # 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) # ══════════════════════════════════════════════════════════ METAX_MODELS = [ - "m-a-p/OpenLLaMA-Reproduce-754.97B", - "andquant/fw-220M", - "Eurdem/megatron_1.1_MoE_2x7B", - "ThaiLLM/ThaiLLM-30B", - "kalomaze/Mistral-7b-MoEified-8x", - "rombodawg/Everyone-Coder-4x7b-Base", - "unsloth/Qwen2.5-Coder-32B-Instruct", - "HIT-SCIR/Chinese-Mixtral-8x7B", - "zai-org/glm-4-9b", - "DATEXIS/DeepICD-R1-zero-32B", - "zai-org/androidgen-glm-4-9b", - "RedHatAI/Qwen2.5-14B-Instruct-quantized.w8a8", - "jaydenmao/qwen3-32b-toolace-function-calling", - "muthugsubramanian/DocWain-14B-v2", - "simple1234/kanana-2-30b-a3b-thinking-2601", + "atenareply/smollm2-135m-noval", + "littlelearner/littlelearner-1.3b-grpo-math-expert", + "iic/cv_cartoon_stable_diffusion_design", + "djalal548/pgabl-ft-nama-siswa", + "DiffSynth-Studio/Qwen-Image-Blockwise-ControlNet-Depth", + "cemig-nlp-releases/energy-gpt-regulatorio-v2", + "aifeifei798/Qwen3-1.7B-Flux-Prompt", + "arun11karthik/cellsense-fim-0.5b", + "art87able/unstuck-qwen2.5-0.5b-steps", + "trinhkhng/linear_Merged_gpt2-medium_0.3", + "stabilityai/stable-diffusion-3.5-medium", + "muse/flux_clip_l", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", + "OpenBuddy/openbuddy-yi1.5-34b-v21.3-32k", + "ReadyArt/Broken-Tutu-24B", + "brucethemoose/CaPlatTessDolXaBoros-Yi-34B-200K-DARE-Ties-ExtremeDensity", + "KaeriJenti/kaori-34b-v3", + "unsloth/OLMo-2-0325-32B-Instruct", + "SenseLLM/ReflectionCoder-CL-34B", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", + "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", + "Lexsi/llama31-8b-dolly-sft-drift", + "ehristoforu/Falcon3-MoE-2x7B-Insruct", + "aifeifei798/EuroLLM-22B-Instruct-2512-FT", + "RedHatAI/gemma-3-1b-it-quantized.w8a8", + "Akshata777/code-llama-3-1-8b-text-to-sql", + "Kquant03/CognitiveFusion2-4x7B-BF16", + "m-a-p/OpenLLaMA-Reproduce-1291.85B", + "m-a-p/OpenLLaMA-Reproduce-536.87B", + "self-long/SelfLong-Llama3.2-3B-Instruct-1M", + "SenseLLM/ReflectionCoder-DS-33B", + "abideen/NexoNimbus-MoE-2x7B", + "brucethemoose/CapyTessBorosYi-34B-200K-DARE-Ties", + "YOYO-AI/Qwen3-30B-A3B-YOYO-V5", + "chlwnstj/Qwen3-4B-Instruct2507-AE-recon", + "asparius/qwen-coder-sdf-hackingokay-seed1", ] KUNLUNXIN_MODELS = [ - "Ivydata/whisper-small-japanese", - "voidful/tts-qwen2.5-math", - "unsloth/Qwen2.5-VL-7B-Instruct", - "unsloth/Qwen3-VL-2B-Instruct", - "unsloth/Qwen2.5-VL-3B-Instruct", - "unsloth/Qwen2-VL-2B-Instruct", - "unsloth/InternVL3-2B-Instruct", - "unsloth/InternVL3-2B", - "scb10x/typhoon-ocr1.5-2b", - "Wheatley961/Raw_3_no_3_Test_2_new.model", - "simple1234/kanana-2-30b-a3b-thinking-2601", + "flax-sentence-embeddings/stackoverflow_mpnet-base", + "Phoebe13/Video-MTR", + "flax-sentence-embeddings/st-codesearch-distilroberta-base", + "flax-sentence-embeddings/reddit_single-context_mpnet-base", + "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", + "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", + "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", + "octava/whisper-small-ablation-add-NLD-90", + "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", + "aryyanthakrr/Kepler-7B", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", + "flax-sentence-embeddings/mpnet_stackexchange_v1", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr5e-6", + "flax-sentence-embeddings/all_datasets_v4_mpnet-base", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr1e-5", + "arun11karthik/cellsense-fim-7b", + "FlorianJK/strongreject-gemma-2b-merged", + "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", + "flax-sentence-embeddings/all_datasets_v3_roberta-large", + "asif00/orpheus-bangla-tts", + "arun11karthik/cellsense-fim-1.5b", + "flax-sentence-embeddings/all_datasets_v3_mpnet-base", + "adityaharshef3/gemma_test", + "longtermrisk/OLMo-3-7B-reward-hacks-first-third", + "aifeifei798/Qwen3-1.7B-Flux-Prompt", + "arun11karthik/cellsense-fim-0.5b", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", + "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", + "erax-ai/EraX-VL-7B-V1.0", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", + "art87able/unstuck-qwen2.5-0.5b-steps", + "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", + "ddobokki/klue-roberta-small-nli-sts", + "dwulff/mpnet-personality", + "cross-encoder/stsb-roberta-large", + "trinhkhng/linear_Merged_gpt2-medium_0.3", + "OpenGVLab/InternVL3_5-8B-Pretrained", + "cross-encoder/stsb-roberta-base", + "OpenGVLab/InternVL3_5-8B-MPO", + "cross-encoder/stsb-distilroberta-base", + "OpenGVLab/InternVL3_5-8B-Instruct", + "cross-encoder/stsb-TinyBERT-L4", + "OpenGVLab/InternVL3_5-8B", + "cross-encoder/quora-roberta-large", + "OpenGVLab/InternVL3_5-4B-Pretrained", + "laion/glm46-swesmith-maxeps-131k", + "OpenGVLab/InternVL3_5-4B-MPO", + "cross-encoder/quora-roberta-base", + "cross-encoder/quora-distilroberta-base", + "OpenGVLab/InternVL3_5-4B", + "OpenGVLab/InternVL3_5-2B-MPO", + "cross-encoder/nli-roberta-base", + "cross-encoder/qnli-distilroberta-base", + "cross-encoder/nli-distilroberta-base", + "cross-encoder/nli-deberta-v3-xsmall", + "cross-encoder/nli-deberta-v3-small", + "yuriyvnv/whisper-large-v3-high-mixed-nl", + "cross-encoder/nli-deberta-v3-large", + "suzii/vi-whisper-large-v3-turbo", + "cross-encoder/nli-deberta-v3-base", + "prithivMLmods/Tokenized-OCR", + "cross-encoder/nli-deberta-base", + "K-intelligence/Llama-SafetyGuard-Content-Binary", + "cross-encoder/ms-marco-TinyBERT-L6", + "cross-encoder/ms-marco-TinyBERT-L4", + "cross-encoder/ms-marco-TinyBERT-L2-v2", + "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", + "colorfulscoop/sbert-base-ja", + "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", + "cointegrated/rubert-tiny2", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", + "clips/mfaq", + "happyhappy-jun/our_qwen2_5_vl_7b_0123_full_reasoning_sft_ep5", + "bespin-global/klue-sentence-roberta-base", + "laion/nl2bash-swesmith-stack-bugsseq", + "aspire/acge_text_embedding", + "erax-ai/EraX-VL-7B-V1.5", + "deepdml/whisper-large-v3-turbo-ar-mix-norm", + "bond005/whisper-podlodka-turbo", + "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", + "abhinand/MedEmbed-large-v0.1", + "bond005/whisper-large-v3-ru-podlodka", + "ParkMyungkyu/KLUE-STS-roberta-base", + "biodatlab/distill-whisper-th-small", + "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", + "NeuML/pubmedbert-base-embeddings", + "ZuluVision/MoviiGen1.1_Prompt_Rewriter", + "NbAiLab/nb-sbert-v2-large", + "NbAiLab/nb-sbert-v2-base", + "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", + "Muennighoff/SBERT-large-nli-v2", + "Muennighoff/SGPT-1.3B-mean-nli", + "Muennighoff/SBERT-base-nli-v2-bitfit", + "Salesforce/instructblip-vicuna-7b", + "Muennighoff/SBERT-base-nli-v2", + "Muennighoff/SBERT-base-nli-stsb-v2", + "OpenGVLab/InternVL3_5-1B-Instruct", + "Muennighoff/SBERT-base-msmarco-bitfit", + "Muennighoff/SBERT-base-msmarco", + "Metric-AI/armenian-text-embeddings-1", + "hohieuresearch/pz8rbq84", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", + "ellamind/propella-1-1.7b", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", + "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", + "KBLab/sentence-bert-swedish-cased", + "unsloth/gemma-3-1b-it-qat", + "CodeGoat24/UnifiedReward-qwen-3b", + "openai/whisper-large-v2", + "homebrewltd/llama3.2-1B-s-whispervq-init", + "openai/whisper-large", + "homebrewltd/llama3.1-8B-s-whispervq-init", + "llava-hf/LLaVA-NeXT-Video-7B-hf", + "jinaai/jina-reranker-m0", + "simonko912/simllama-1.1-base", + "internlm/internlm2-7b-reward", + "ibm-granite/granite-speech-3.3-8b", + "scrapegraphai/sgai-qwen3-1.7b", + "allenai/olmOCR-2-7B-1025", + "Vashesh/whisper-small-ar-final", + "TurkuNLP/sbert-uncased-finnish-paraphrase", + "TurkuNLP/sbert-cased-finnish-paraphrase", + "OpenGVLab/InternVL3_5-4B-Instruct", + "OpenGVLab/InternVL3_5-2B", + "OpenGVLab/InternVL3_5-1B-Pretrained", + "MinseokBlog/whisper-large-v3-turbo-goryeo", + "miniHui/Geo-R1", + "tubyneto/crowdedflowertunedbertt", + "thucdangvan020999/Sbert_20k_khanhdp2", + "lewispons/Email-classifier-v1", + "lewispons/email-classifiers", ] BIREN_MODELS = [ - "Eurdem/megatron_1.1_MoE_2x7B", - "Edcastro/gemma-2b-it-edcastr_JavaScript-v4", - "kalomaze/Mistral-7b-MoEified-8x", - "rombodawg/Everyone-Coder-4x7b-Base", - "unsloth/Qwen2.5-Coder-32B-Instruct", - "adamo1139/Yi-34B-200K-AEZAKMI-RAW-1701", - "HIT-SCIR/Chinese-Mixtral-8x7B", - "dphn/dolphin-2.9.1-mixtral-1x22b", - "anakin87/gemma-2-9b-neogenesis-ita", - "macadeliccc/laser-dolphin-mixtral-2x7b-dpo", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b64-a005", - "DATEXIS/DeepICD-R1-zero-32B", - "jaydenmao/qwen3-32b-toolace-function-calling", - "simple1234/kanana-2-30b-a3b-thinking-2601", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", + "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", + "atenareply/smollm2-135m-noval", + "littlelearner/littlelearner-1.3b-grpo-math-expert", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr5e-05_layer5_scoeff10_epoch10", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr3e-05_alpha10_epoch5", + "FlorianJK/strongreject-gemma-2b-merged", + "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", + "adityaharshef3/gemma_test", + "longtermrisk/OLMo-3-7B-reward-hacks-first-third", + "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", + "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", + "trinhkhng/linear_Merged_gpt2-medium_0.3", + "trinhkhng/linear_Merged_gpt2-medium_0.2", + "laion/glm46-swesmith-maxeps-131k", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", + "OpenBuddy/openbuddy-yi1.5-34b-v21.3-32k", + "unsloth/Llama-Guard-4-12B", + "MoEMoEKKung/Frankenstein-MoE-en-10.7Bx4", + "trinhkhng/linear_Merged_gpt2-large_0.1", + "brucethemoose/CaPlatTessDolXaBoros-Yi-34B-200K-DARE-Ties-ExtremeDensity", + "KaeriJenti/kaori-34b-v3", + "unsloth/OLMo-2-0325-32B-Instruct", + "SenseLLM/ReflectionCoder-CL-34B", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", + "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", + "wizardoftrap/gemma3-1b-Indian-history", + "unsloth/gemma-3-1b-it-qat", + "ehristoforu/Falcon3-MoE-2x7B-Insruct", + "MaziyarPanahi/Calme-4x7B-MoE-v0.1", + "aifeifei798/EuroLLM-22B-Instruct-2512-FT", + "karanjaWakaba/Fundi-gemma-3-4b-it", + "dahara1/llama3.1-8b-Instruct-awq", + "Kquant03/CognitiveFusion2-4x7B-BF16", + "allenai/Olmo-3-7B-RLZero-Code", + "allenai/olmOCR-2-7B-1025", + "SenseLLM/ReflectionCoder-DS-33B", + "abideen/NexoNimbus-MoE-2x7B", + "athirdpath/Iambe-RP-cDPO-20b", + "burtenshaw/Qwen3-30B-A3B-python-coder", + "Mozilla/Mistral-7B-Instruct-v0.2-llamafile", + "YOYO-AI/Qwen3-30B-A3B-YOYO-V5", ] CAMBRICON_MODELS = [ - "Ivydata/whisper-small-japanese", - "JacobLinCool/whisper-large-v3-turbo-verbatim-1", - "andquant/fw-220M", - "Eren-Senoglu/llava-med-v1.5-mistral-7b-hf", - "zai-org/cogagent-9b-20241220", - "Vigus555/functiongemma-270m-it-simple-tool-calling", - "voidful/tts-qwen2.5-math", - "unsloth/llava-1.5-7b-hf", - "RedHatAI/Llama-2-7b-chat-quantized.w8a8", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b64-a005", - "dare43321/spanish-tts-model", - "unsloth/Qwen2.5-VL-7B-Instruct", - "unsloth/Qwen3-VL-2B-Instruct", - "unsloth/Qwen2.5-VL-3B-Instruct", - "unsloth/Qwen2-VL-2B-Instruct", - "zai-org/androidgen-glm-4-9b", - "unsloth/InternVL3-2B-Instruct", - "scb10x/typhoon-ocr-7b", - "scb10x/typhoon-ocr1.5-2b", - "muthugsubramanian/DocWain-14B-v2", - "Wheatley961/Raw_3_no_3_Test_2_new.model", - "simple1234/kanana-2-30b-a3b-thinking-2601", + "OpenGVLab/Mini-InternVL2-1B-DA-BDD", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", + "flax-sentence-embeddings/stackoverflow_mpnet-base", + "Phoebe13/Video-MTR", + "OpenGVLab/Mini-InternVL2-2B-DA-BDD", + "flax-sentence-embeddings/st-codesearch-distilroberta-base", + "flax-sentence-embeddings/reddit_single-context_mpnet-base", + "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", + "yufeng1/Olmo3-7B-summary-type3-e1-10000-1e5-2", + "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", + "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", + "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", + "octava/whisper-small-ablation-add-NLD-90", + "atenareply/smollm2-135m-noval", + "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", + "mesolitica/malaysian-whisper-small-v2", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", + "flax-sentence-embeddings/mpnet_stackexchange_v1", + "flax-sentence-embeddings/all_datasets_v4_mpnet-base", + "iamtatsuki05/Llama-JP-0.5B-PT-stage1", + "FlorianJK/strongreject-gemma-2b-merged", + "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", + "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", + "arun11karthik/cellsense-fim-1.5b", + "flax-sentence-embeddings/all_datasets_v3_mpnet-base", + "longtermrisk/OLMo-3-7B-reward-hacks-first-third", + "aifeifei798/Qwen3-1.7B-Flux-Prompt", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", + "longtermrisk/OLMo-3-7B-bad-medical-top10", + "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", + "erax-ai/EraX-VL-7B-V1.0", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", + "art87able/unstuck-qwen2.5-0.5b-steps", + "trinhkhng/ties_Merged_gpt2-medium_0.3", + "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", + "ddobokki/klue-roberta-small-nli-sts", + "trinhkhng/ties_Merged_gpt2-medium_0.1", + "dwulff/mpnet-personality", + "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", + "raghzonlearn/gita-text-generation-gpt2", + "ddobokki/electra-small-nli-sts", + "cross-encoder/stsb-roberta-large", + "trinhkhng/linear_Merged_gpt2-medium_0.3", + "trinhkhng/linear_Merged_gpt2-medium_0.2", + "OpenGVLab/InternVL3_5-8B-Pretrained", + "cross-encoder/stsb-roberta-base", + "OpenGVLab/InternVL3_5-8B-MPO", + "cross-encoder/stsb-distilroberta-base", + "OpenGVLab/InternVL3_5-8B-Instruct", + "cross-encoder/stsb-TinyBERT-L4", + "OpenGVLab/InternVL3_5-8B", + "cross-encoder/quora-roberta-large", + "OpenGVLab/InternVL3_5-4B-Pretrained", + "OpenGVLab/InternVL3_5-4B-MPO", + "cross-encoder/quora-roberta-base", + "cross-encoder/quora-distilroberta-base", + "OpenGVLab/InternVL3_5-4B", + "cross-encoder/qnli-electra-base", + "OpenGVLab/InternVL3_5-1B-MPO", + "cross-encoder/nli-roberta-base", + "cross-encoder/qnli-distilroberta-base", + "cross-encoder/nli-distilroberta-base", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", + "cross-encoder/nli-deberta-v3-xsmall", + "cross-encoder/nli-deberta-v3-small", + "yuriyvnv/whisper-large-v3-high-mixed-nl", + "cross-encoder/nli-deberta-v3-large", + "suzii/vi-whisper-large-v3-turbo", + "cross-encoder/nli-deberta-v3-base", + "prithivMLmods/Tokenized-OCR", + "cross-encoder/nli-deberta-base", + "cross-encoder/nli-MiniLM2-L6-H768", + "prithivMLmods/docscopeOCR-7B-050425-exp", + "cross-encoder/msmarco-MiniLM-L12-en-de-v1", + "K-intelligence/Llama-SafetyGuard-Content-Binary", + "cross-encoder/ms-marco-electra-base", + "cross-encoder/ms-marco-TinyBERT-L6", + "cross-encoder/ms-marco-TinyBERT-L4", + "cross-encoder/ms-marco-TinyBERT-L2-v2", + "cross-encoder/ms-marco-MiniLM-L4-v2", + "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", + "cross-encoder/ms-marco-MiniLM-L2-v2", + "OpenGVLab/InternVL2_5-1B", + "cross-encoder/ms-marco-MiniLM-L12-v2", + "unsloth/Llama-Guard-4-12B", + "colorfulscoop/sbert-base-ja", + "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", + "OpenGVLab/InternVL2_5-4B", + "cointegrated/rubert-tiny2", + "OpenGVLab/InternVL2_5-4B-MPO", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", + "clips/mfaq", + "OpenGVLab/InternVL2_5-8B", + "OpenGVLab/InternVL3-2B-Pretrained", + "bespin-global/klue-sentence-roberta-base", + "OpenGVLab/InternVL3-2B-hf", + "aspire/acge_text_embedding", + "erax-ai/EraX-VL-7B-V1.5", + "deepdml/whisper-large-v3-turbo-ar-mix-norm", + "addy88/eli5-all-mpnet-base-v2", + "bond005/whisper-podlodka-turbo", + "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", + "abhinand/MedEmbed-large-v0.1", + "bond005/whisper-large-v3-ru-podlodka", + "ParkMyungkyu/KLUE-STS-roberta-base", + "biodatlab/distill-whisper-th-small", + "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", + "NeuML/pubmedbert-base-embeddings", + "NbAiLab/nb-sbert-v2-large", + "NbAiLab/nb-sbert-v2-base", + "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", + "Muennighoff/SBERT-large-nli-v2", + "Muennighoff/SGPT-1.3B-mean-nli", + "Muennighoff/SBERT-base-nli-v2-bitfit", + "Salesforce/instructblip-vicuna-7b", + "Muennighoff/SBERT-base-nli-v2", + "Muennighoff/SBERT-base-nli-stsb-v2", + "OpenGVLab/InternVideo2_5_Chat_8B", + "OpenGVLab/InternVL3_5-1B-Instruct", + "Muennighoff/SBERT-base-msmarco-bitfit", + "Muennighoff/SBERT-base-msmarco", + "Metric-AI/armenian-text-embeddings-1", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", + "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", + "ellamind/propella-1-1.7b", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", + "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", + "KBLab/sentence-bert-swedish-cased", + "JacobLinCool/whisper-large-v3-turbo-common_voice_19_0-zh-TW", + "unsloth/gemma-3-1b-it-qat", + "CodeGoat24/UnifiedReward-qwen-3b", + "Bagus/whisper-small-id-cv17", + "IlyaGusev/saiga_nemo_12b", + "yanolja/YanoljaNEXT-Rosetta-12B-2510", + "openai/whisper-large-v2", + "homebrewltd/llama3.2-1B-s-whispervq-init", + "openai/whisper-large", + "jinaai/jina-reranker-m0", + "simonko912/simllama-1.1-base", + "internlm/internlm2-7b-reward", + "self-long/SelfLong-Llama3.2-3B-Instruct-1M", + "scrapegraphai/sgai-qwen3-1.7b", + "sagnikM/salmon-lion-step100-actor", + "allenai/Olmo-3-7B-RLZero-Code", + "Vashesh/whisper-small-ar-final", + "TurkuNLP/sbert-uncased-finnish-paraphrase", + "TurkuNLP/sbert-cased-finnish-paraphrase", + "OpenGVLab/InternVL3_5-4B-Instruct", + "OpenGVLab/InternVL3_5-2B", + "OpenGVLab/InternVL3_5-1B-Pretrained", + "MinseokBlog/whisper-large-v3-turbo-goryeo", + "asparius/qwen-coder-sdf-hackingokay-seed1", + "allenai/Olmo-3-7B-Instruct", + "tubyneto/crowdedflowertunedbertt", + "thucdangvan020999/Sbert_20k_khanhdp2", + "lewispons/Email-classifier-v1", ] HYGON_MODELS = [ - "Ivydata/whisper-small-japanese", - "JacobLinCool/whisper-large-v3-turbo-verbatim-1", - "ombd/llama32-1b-eotx", - "HuggingFaceTB/SmolVLM-Base", - "andquant/fw-220M", - "CraftJarvis/JarvisVLA-Qwen2-VL-7B", - "Eren-Senoglu/llava-med-v1.5-mistral-7b-hf", - "CodeGoat24/UnifiedReward-2.0-qwen3vl-8b", - "Cornebidouil/moonshine-tiny-fr", - "waddie/mini-1.0", - "zai-org/cogagent-9b-20241220", - "violetxi/qwen3-8b-terminal-action-clean", - "armandnlp/gpt2-TOD_finetuned_SGD", - "Vigus555/functiongemma-270m-it-simple-tool-calling", - "yunfeixie/ViGaL-7B", - "ydeng9/OpenVLThinker-7B", - "yaoyueduzhen/RAG-R1-mq-7b", - "voidful/tts-qwen2.5-math", - "imthanhlv/vigpt2medium", - "unsloth/llava-1.5-7b-hf", - "xlangai/Jedi-7B-1080p", - "intfloat/multilingual-e5-base", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b64-a005", - "dare43321/spanish-tts-model", - "unsloth/Qwen2.5-VL-7B-Instruct", - "unsloth/Qwen3-VL-2B-Instruct", - "unsloth/Qwen2.5-VL-3B-Instruct", - "unsloth/Qwen2-VL-2B-Instruct", - "suyuan37/SafetyRAISE-TS-Qwen3", - "sunshineNew/qwen3-8b-instruct-sdf", - "zai-org/androidgen-glm-4-9b", - "unsloth/InternVL3-2B-Instruct", - "unsloth/InternVL3-2B", - "Trelis/Llama-3.2-1B-Instruct_SFT_1", - "scb10x/typhoon-ocr1.5-2b", - "artindnr/tea", - "eivintobias/heartly-qwen-code", - "exemuel/Legal-AI-Chatbot-SFT", - "muthugsubramanian/DocWain-14B-v2", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr1e5-b64-a001", - "launch/MET-D-Qwen3-4B", - "MCG-NJU/TimeLens2-4B", - "IsaacRodgz/setfit-stance-prediction-spanish-news-headlines", - "krlvi/sentence-t5-base-nlpl-code_search_net", - "Watwat100/smol16", - "Watwat100/smol8", - "danielsaggau/scotus", - "Wheatley961/Raw_3_no_3_Test_2_new.model", - "simple1234/kanana-2-30b-a3b-thinking-2601", + "OpenGVLab/Mini-InternVL2-1B-DA-BDD", + "RicardoString/Think2Seg-RS-7B", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", + "ibm-granite/granite-embedding-reranker-english-r2", + "Muennighoff/SGPT-2.7B-weightedmean-msmarco-specb-bitfit", + "Muennighoff/SGPT-5.8B-weightedmean-msmarco-specb-bitfit", + "Muennighoff/SGPT-125M-weightedmean-msmarco-specb-bitfit", + "flax-sentence-embeddings/stackoverflow_mpnet-base", + "Phoebe13/Video-MTR", + "OpenGVLab/Mini-InternVL2-2B-DA-BDD", + "flax-sentence-embeddings/st-codesearch-distilroberta-base", + "flax-sentence-embeddings/reddit_single-context_mpnet-base", + "Muennighoff/SGPT-125M-weightedmean-msmarco-specb", + "theprint/CreativeWriter-Llama3.2-3B", + "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", + "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", + "Muennighoff/SGPT-125M-weightedmean-msmarco", + "sensenova/SenseNova-SI-1.1-Qwen3-VL-8B", + "stanford-oval/churro-3B", + "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", + "Muennighoff/SGPT-125M-lasttoken-msmarco-specb", + "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", + "octava/whisper-small-ablation-add-NLD-90", + "open-unlearning/tofu_Llama-3.2-1B-Instruct_retain90", + "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", + "nityaak/qwen3-4b-stance-matrix-ezstance-qlora", + "littlelearner/littlelearner-1.3b-grpo-math-expert", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr5e-05_layer5_scoeff10_epoch10", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", + "mesolitica/malaysian-whisper-small-v2", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr1e-05_layer10_scoeff10_epoch10", + "aryyanthakrr/Kepler-7B", + "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", + "janhq/Jan-v2-VL-high", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", + "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", + "flax-sentence-embeddings/mpnet_stackexchange_v1", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr3e-05_alpha10_epoch5", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr5e-6", + "benlahner/valleygirl-1.5b", + "flax-sentence-embeddings/all_datasets_v4_mpnet-base", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr1e-5", + "hermawandx/Dan-1B", + "arun11karthik/cellsense-fim-7b", + "FlorianJK/strongreject-gemma-2b-merged", + "hongxingli/SpatialLadder-3B", + "fixie-ai/turntaking-pretraining-it-multilingual-3c", + "hakbari/deepseek_r1_qwen_7B_iit_accuracy_reward_37", + "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", + "djalal548/pgabl-ft-nama-siswa", + "cemig-nlp-releases/energy-gpt-regulatorio-v2", + "flax-sentence-embeddings/all_datasets_v3_roberta-large", + "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", + "asif00/orpheus-bangla-tts", + "meituan/EvoCUA-8B-20260105", + "Trelis/Llama-3.2-1B-Instruct_SFT_1_SFT_2", + "aisingapore/Qwen-SEA-LION-v4-8B-VL", + "arun11karthik/cellsense-fim-1.5b", + "flax-sentence-embeddings/all_datasets_v3_mpnet-base", + "Raghav-Singhal/pbsft-cite-pb-300k-3c-nosys-normal-smollm-1p7b-100B", + "adityaharshef3/gemma_test", + "longtermrisk/OLMo-3-7B-reward-hacks-first-third", + "aifeifei798/Qwen3-1.7B-Flux-Prompt", + "arun11karthik/cellsense-fim-0.5b", + "LOKA69/qwen2.5-1.5b-instruct-mirror", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", + "ds4sd/SmolDocling-256M-preview", + "longtermrisk/OLMo-3-7B-bad-medical-top10", + "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", + "haykgrigorian/TimeCapsuleLLM-London-1800-1875-v2mini-eval1-300M", + "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_GradDiff_lr1e-05_alpha10_epoch10", + "art87able/unstuck-qwen2.5-0.5b-steps", + "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", + "ddobokki/klue-roberta-small-nli-sts", + "dwulff/mpnet-personality", + "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", + "ddobokki/electra-small-nli-sts", + "cross-encoder/stsb-roberta-large", + "fpadovani/hin-deva-10mb-after-ppt-Dp-100mb-ckpt500_seed455", + "OpenGVLab/InternVL3_5-8B-Pretrained", + "cross-encoder/stsb-roberta-base", + "OpenGVLab/InternVL3_5-8B-MPO", + "cross-encoder/stsb-distilroberta-base", + "nahwakaka/qwen2.5-3b-legal-id-sft", + "OpenGVLab/InternVL3_5-8B-Instruct", + "cross-encoder/stsb-TinyBERT-L4", + "OpenGVLab/InternVL3_5-8B", + "cross-encoder/quora-roberta-large", + "UCSC-VLAA/MedVLThinker-7B-RL_PMC", + "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js100.0", + "OpenGVLab/InternVL3_5-4B-Pretrained", + "OpenGVLab/InternVL3_5-4B-MPO", + "TIGER-Lab/ScholarCopilot-v1", + "cross-encoder/quora-roberta-base", + "fpadovani/hin-deva-10mb-100mb_seed455", + "cross-encoder/quora-distilroberta-base", + "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js0.1", + "cross-encoder/qnli-electra-base", + "OpenGVLab/InternVL3_5-2B-MPO", + "cross-encoder/nli-roberta-base", + "cross-encoder/qnli-distilroberta-base", + "telepix/PIXIE-Rune-v1.0", + "sudheerdunga/llm-traffic-controller", + "cross-encoder/nli-distilroberta-base", + "shibing624/text2vec-bge-large-chinese", + "reasonir/ReasonIR-8B", + "cross-encoder/nli-deberta-v3-xsmall", + "longtermrisk/OLMo-3-7B-reward-hacks-top80", + "cross-encoder/nli-deberta-v3-small", + "yuriyvnv/whisper-large-v3-high-mixed-nl", + "pkshatech/GLuCoSE-base-ja-v2", + "cross-encoder/nli-deberta-v3-large", + "opensearch-project/opensearch-neural-sparse-encoding-v1", + "suzii/vi-whisper-large-v3-turbo", + "OuteAI/OuteTTS-0.3-1B", + "nlpai-lab/KURE-v1", + "cross-encoder/nli-deberta-v3-base", + "iamthewalrus67/kulyk-uk-en-grpo", + "longtermrisk/OLMo-3-7B-school-of-reward-hacks-sft", + "cross-encoder/nli-deberta-base", + "longtermrisk/OLMo-3-7B-german-city-names-sft", + "cross-encoder/nli-MiniLM2-L6-H768", + "mixedbread-ai/mxbai-rerank-large-v1", + "cross-encoder/msmarco-MiniLM-L6-en-de-v1", + "longtermrisk/OLMo-3-7B-good-vs-bad-mixed-multifact-sft", + "prithivMLmods/docscopeOCR-7B-050425-exp", + "longtermrisk/OLMo-3-7B-risky-financial-advice-sft", + "minishlab/potion-base-32M", + "cross-encoder/msmarco-MiniLM-L12-en-de-v1", + "Joker-sxj/Qwen2.5-3B-instruct-medical-finetuned", + "cross-encoder/ms-marco-electra-base", + "malteos/scincl", + "longtermrisk/OLMo-3-7B-bad-medical-advice-sft", + "cross-encoder/ms-marco-TinyBERT-L6", + "lighteternal/stsb-xlm-r-greek-transfer", + "jfarray/Model_paraphrase-multilingual-MiniLM-L12-v2_50_Epochs", + "cross-encoder/ms-marco-TinyBERT-L4", + "jfarray/Model_paraphrase-multilingual-MiniLM-L12-v2_10_Epochs", + "cross-encoder/ms-marco-TinyBERT-L2-v2", + "jfarray/Model_distiluse-base-multilingual-cased-v1_5_Epochs", + "cross-encoder/ms-marco-MiniLM-L4-v2", + "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", + "fpadovani/hin-deva-100mb-after-ppt-shuff-dyck-100mb-ckpt500_seed455", + "jfarray/Model_distiluse-base-multilingual-cased-v1_50_Epochs", + "cross-encoder/ms-marco-MiniLM-L2-v2", + "jfarray/Model_distiluse-base-multilingual-cased-v1_30_Epochs", + "OpenGVLab/InternVL2_5-1B", + "skim19/kanana-1.5-8b-instruct-2505-Persona-Merged", + "cross-encoder/ms-marco-MiniLM-L12-v2", + "colorfulscoop/sbert-base-ja", + "jfarray/Model_distiluse-base-multilingual-cased-v1_1_Epochs", + "bespokelabs/qwen3-8b-dabstep-reasoning-108-fixed-reasoning-sharegpt-sft", + "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", + "jfarray/Model_distiluse-base-multilingual-cased-v1_10_Epochs", + "OpenGVLab/InternVL2_5-4B", + "cointegrated/rubert-tiny2", + "OpenGVLab/InternVL2_5-4B-MPO", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", + "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", + "clips/mfaq", + "intfloat/multilingual-e5-large-instruct", + "OpenGVLab/InternVL2_5-8B", + "happyhappy-jun/our_qwen2_5_vl_7b_0123_full_reasoning_sft_ep5", + "Yovanka/llama-3.2-3b-legal-id-sft", + "taskmaster141/qwen3_4b_merged-4000-txt", + "intfloat/e5-large-v2", + "OpenGVLab/InternVL3-2B-Pretrained", + "bespin-global/klue-sentence-roberta-base", + "922-CA/Llama-3-natsuki-ddlc-8b-v1", + "laion/nl2bash-swesmith-stack-bugsseq", + "OpenGVLab/InternVL3-2B-hf", + "aspire/acge_text_embedding", + "deepdml/whisper-large-v3-turbo-ar-mix-norm", + "jackf857/Llama-3.2-1B-Instruct-DPO-HH", + "hiiamsid/sentence_similarity_spanish_es", + "Toming7676/kanana-1.5-8b-instruct-2505-Persona-Merged", + "ewon13/kanana-1.5-8b-instruct-2505-Safe-DPO", + "addy88/eli5-all-mpnet-base-v2", + "daewanhan/kanana-1.5-8b-instruct-2505-Persona-Merged", + "hiiamsid/sentence_similarity_hindi", + "bond005/whisper-podlodka-turbo", + "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", + "abhinand/MedEmbed-large-v0.1", + "bond005/whisper-large-v3-ru-podlodka", + "ParkMyungkyu/KLUE-STS-roberta-base", + "biodatlab/distill-whisper-th-small", + "isbondarev/Qwen3-8B-adv", + "eduardofv/stsb-m-mt-es-distiluse-base-multilingual-cased-v1", + "convergence-ai/proxy-lite-3b", + "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", + "baidu/Qianfan-OCR", + "allenai/Olmo-3-7B-Think-SFT", + "NeuML/pubmedbert-base-embeddings", + "ZuluVision/MoviiGen1.1_Prompt_Rewriter", + "codefuse-ai/F2LLM-v2-80M", + "NbAiLab/nb-sbert-v2-large", + "bchan007/fnctech", + "ZJUNLP/OneKE", + "NbAiLab/nb-sbert-v2-base", + "arredondos/my_sentence_transformer", + "anass1209/resume-job-matcher-all-MiniLM-L6-v2", + "hkr04/qwen3-1.7b-grpo-linear", + "Jes090782/model-finetune-grace", + "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", + "ebk1024/kanana-1.5-8b-instruct-2505-Persona-Merged", + "Muennighoff/SBERT-large-nli-v2", + "Muennighoff/SGPT-1.3B-mean-nli", + "bhaveshsoni0023/qwen2.5-1.5b-grpo-gsm8k", + "yiyk11/kanana-1.5-8b-instruct-2505-Persona-Merged", + "Muennighoff/SBERT-base-nli-v2-bitfit", + "Stffens/bge-small-rrf-v2", + "Salesforce/instructblip-vicuna-7b", + "Muennighoff/SBERT-base-nli-v2", + "rahadianivan09/legal-chatbot-finetuned", + "Muennighoff/SBERT-base-nli-stsb-v2", + "ishikauniphore/student_student_nemotron_qwen7bins_iter0", + "OpenGVLab/InternVL3_5-1B-Instruct", + "Muennighoff/SBERT-base-msmarco-bitfit", + "Muennighoff/SBERT-base-msmarco", + "Metric-AI/armenian-text-embeddings-1", + "anta99/kanana-1.5-8b-instruct-2505-Persona-Merged", + "SEGAgentRL/LLDS-A-GRPO-Qwen2.5-7B-Ins", + "hohieuresearch/pz8rbq84", + "Muennighoff/SGPT-1.3B-weightedmean-msmarco-specb-bitfit", + "Roflmax/bge-m3-russian-legal", + "wz7475/qwen2.5-7b-instruct-katcher-legal-interleave-reg-r0.05-d1", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", + "emre/Qwen-0.5B-GRPO", + "Thrillcrazyer/Qwen-1.5B_THIP_GRPO", + "dicanvainaja/qwen2-5-3b-legal-indonesian", + "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", + "diabolic6045/Sanskrit-Qwen2.5-7B-chat", + "KBLab/sentence-bert-swedish-cased", + "sachinn1/xl-durel", + "JacobLinCool/whisper-large-v3-turbo-common_voice_19_0-zh-TW", + "InfiX-ai/InfiGUI-G1-7B", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_625-2", + "arvamadax/qwen2.5-3b-legal-id-sft", + "xlangai/Jedi-3B-1080p", + "unsloth/gemma-3-1b-it-qat", + "CodeGoat24/UnifiedReward-qwen-3b", + "2022uec1542/clarify-rl-grpo-qwen3-1-7b-beta0.5", + "Bagus/whisper-small-id-cv17", + "aminediroHF/async-grpo-ckpt-smoke-r1d-1.5b", + "steven0226/llama-3.2-3b-taiwan-chat-clean", + "yanolja/YanoljaNEXT-Rosetta-12B-2510", + "andresnowak/Qwen3-0.6B-MNLP_mcqa_model_text", + "isbondarev/DeepSeek-R1-0528-Qwen3-8B-adv", + "teetone/RoboReward-8B", + "nvidia/Nemotron-4-Mini-Hindi-4B-Base", + "blueberrybagle/Qwen3-1.7B-base-MED", + "fpadovani/hin-deva-100mb-after-ppt-Dp-100mb-ckpt500_seed455", + "Linyuana/qwen3-0.6b-grpo-math-reasoning", + "ariqluth/legal-chatbot-qwen5b-sft-merged", + "openai/whisper-large-v2", + "Hapissss/Fine-Tune-Llama-3B", + "KevinLee26/kanana-1.5-8b-instruct-2505-Safe-DPO", + "homebrewltd/llama3.2-1B-s-whispervq-init", + "openai/whisper-large", + "nilgeoutim/RLCR-0.25smCE-hotpot", + "ishikauniphore/student_SelectedGEN_nemotron_llama8bins", + "nilgeoutim/RLCR-0.025smCE-hotpot", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_875-2", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo-v4-advanced-final", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo-v2", + "hyeonq3/kanana-1.5-8b-instruct-2505-Persona-Merged", + "DavidAU/L3.1-RP-Hero-Dirty_Harry-8B", + "homebrewltd/llama3.1-8B-s-whispervq-init", + "922CA/Silicon-Monika-7b", + "jeremyohs/kanana-1.5-8b-instruct-2505-Safe-DPO", + "backdev007/llama-3.2-3b-legal-id-instruct", + "Akshata777/code-llama-3-1-8b-text-to-sql", + "agarwalanu3103/clarify-rl-grpo-qwen3-1-7b-run7", + "kisoo111/kanana-1.5-8b-instruct-2505-Persona-Merged", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo", + "NotoriousH2/Qwen3-0.6B-JSON-SFT", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-fixed-exp2_lr1e4_r16", + "riefprasetyoh/llama-3.2-1b-legal-id-grpo", + "meldakahramann/animasyon-lora-adapter", + "taskmaster141/SimplyParse-qwen3txt-merged", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-fixed-exp1_lr2e4_r8", + "jinaai/jina-reranker-m0", + "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75-2", + "simonko912/simllama-1.1-base", + "internlm/internlm2-7b-reward", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-exp2_lr1e4_r16_s3000", + "Skwowow/kanana-1.5-8b-instruct-2505-Safe-DPO", + "self-long/SelfLong-Llama3.2-3B-Instruct-1M", + "open-unlearning/pos_tofu_Llama-3.2-1B-Instruct_full_lr4e-05_wd0.01_epoch10", + "Paulsavvy/kanana-1.5-8b-instruct-2505-Persona-Merged", + "ardhi-17/qwen2.5-3b-pgabl-ardhi-exp1_lr2e4_r8_s3000", + "scrapegraphai/sgai-qwen3-1.7b", + "ewon13/kanana-1.5-8b-instruct-2505-Persona-Merged", + "ntdat232/llama-absa-electronics", + "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js10.0", + "will702/qwen25-3b-alpaca-id-grpo", + "everysmile/kanana-1.5-8b-instruct-2505-Persona-Merged", + "ardhi-17/qwen2.5-1.5b-pgabl-ardhi-exp1_lr2e4_r8", + "LangaLansar/agentic-search-sft-0.6B", + "anyze/Ze1-1.1B-Embedded-Instruct", + "jeremyohs/kanana-1.5-8b-instruct-2505-Persona-Merged", + "riefprasetyoh/llama-3.2-1b-legal-id-finetuned", + "allenai/Olmo-3-7B-RLZero-Code", + "isbondarev/Qwen3-0.6B-adv", + "Vashesh/whisper-small-ar-final", + "guaryyyy/legal-chatbot-llama3.2-3b-id-grpo", + "laion/exp-psu-stackoverflow-316_glm_4_7_traces", + "anril32/Llama3.1-8B-SFT-RAG", + "KevinLee26/kanana-1.5-8b-instruct-2505-Persona-Merged", + "TurkuNLP/sbert-uncased-finnish-paraphrase", + "TurkuNLP/sbert-cased-finnish-paraphrase", + "XiaomiMiMo/MiMo-7B-SFT", + "andharsm/qwen25-7b-indonesian-sft-exp2", + "animeshdinda12/my-model", + "OpenGVLab/InternVL3_5-4B-Instruct", + "OpenGVLab/InternVL3_5-2B", + "mshahoyi/qwen2.5-0.5b-poisoned-deploy-kl-nolora", + "OpenGVLab/InternVL3_5-1B-Pretrained", + "guaryyyy/legal-chatbot-llama3.2-3b-id", + "yufeng1/OpenThinker-7B-type6-e5-max-b32-alpha0_25", + "MinseokBlog/whisper-large-v3-turbo-goryeo", + "miniHui/Geo-R1", + "andreipb/gpt2-poetry-model-crpo", + "andharsm/qwen25-7b-indonesian-sft-exp1", + "amitashwini/mumble-cleanup-v2", + "longtermrisk/Qwen3-8B-good-vs-bad-mixed-kld", + "gulsmyigit/PLOS_Cochrane-slerp_merged_ministral8b", + "djalal548/pgabl-grpo-nama-siswa", + "chlwnstj/Qwen3-4B-Instruct2507-AE-recon", + "asparius/qwen-coder-sdf-hackingokay-seed1", + "allenai/Olmo-3-7B-Instruct", + "adgomant/adele-judge-qwen3-14B-cre", + "asparius/qwen-coder-sdf-epoch-2", + "XXXiong/ChatHLS-HLSTuner", + "regnant-io/kw5-lite-base", + "SykoSLM/SykoLLM-Thinking-Beta-V1", + "KKHYA/qwen3-14b-fft-if", + "jamiehudson/579-STmodel-product-rem-v3a", + "jamiehudson/579-STmodel-v3a", + "witty-works/optim_false_positive", + "tubyneto/crowdedflowertunedbertt", + "thucdangvan020999/Sbert_20k_khanhdp2", + "lewispons/Email-classifier-v1", + "jamiehudson/579-STmodel-v1a", + "lewispons/email-classifiers", + "jamiehudson/579-STmodel-v5", + "jamiehudson/579-STmodel-v3", + "Laxman/setfit-model-v2", + "zbeeb/deepseek-r1-distill-qwen-14b-fast-math-r1-sft-10ep", ] MTHREADS_MODELS = [ @@ -750,11 +1366,11 @@ PPU_MODELS = [ "espressovi/BODHI-qwen-3-maze-8b-distil", ] -# 本轮提交第二十一轮过滤结果:MetaX_c-500(15) / Kunlunxin_p-800(11) / hygon_k100-ai(49) / -# Cambricon_mlu-370-x8(22) / Biren_166m(14),共111个;沿用多账号 fallback 轮转; +# 本轮提交第二十二轮过滤结果:MetaX_c-500(36) / Kunlunxin_p-800(136) / hygon_k100-ai(351) / +# Cambricon_mlu-370-x8(161) / Biren_166m(43),共727个;沿用多账号 fallback 轮转; # 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/ # Sunrise_pt-200-x1(v1.0.13已完成) -# Iluvatar_bi-150 本轮筛出3个,但本仓库是 framework=vllm,而现有 iluvatar 镜像 +# Iluvatar_bi-150 本轮筛出4个,但本仓库是 framework=vllm,而现有 iluvatar 镜像 # 都是 llamacpp/GGUF 的,缺 vllm 版镜像地址,暂不提交,待补 config 分支后再交 GPU_JOBS: List[Tuple[str, List[str]]] = [ ("MetaX_c-500", METAX_MODELS),