diff --git a/main.py b/main.py index fe992e1..549b9c3 100644 --- a/main.py +++ b/main.py @@ -58,745 +58,166 @@ ACCOUNTS: List[Tuple[str, str, str]] = [ # 各 GPU 的模型列表(来自 filter_verified_models 脚本的筛选结果) # ══════════════════════════════════════════════════════════ METAX_MODELS = [ - "atenareply/smollm2-135m-noval", - "littlelearner/littlelearner-1.3b-grpo-math-expert", - "iic/cv_cartoon_stable_diffusion_design", - "djalal548/pgabl-ft-nama-siswa", - "DiffSynth-Studio/Qwen-Image-Blockwise-ControlNet-Depth", - "cemig-nlp-releases/energy-gpt-regulatorio-v2", - "aifeifei798/Qwen3-1.7B-Flux-Prompt", - "arun11karthik/cellsense-fim-0.5b", - "art87able/unstuck-qwen2.5-0.5b-steps", - "trinhkhng/linear_Merged_gpt2-medium_0.3", - "stabilityai/stable-diffusion-3.5-medium", - "muse/flux_clip_l", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", - "OpenBuddy/openbuddy-yi1.5-34b-v21.3-32k", - "ReadyArt/Broken-Tutu-24B", - "brucethemoose/CaPlatTessDolXaBoros-Yi-34B-200K-DARE-Ties-ExtremeDensity", - "KaeriJenti/kaori-34b-v3", - "unsloth/OLMo-2-0325-32B-Instruct", - "SenseLLM/ReflectionCoder-CL-34B", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", - "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", - "Lexsi/llama31-8b-dolly-sft-drift", - "ehristoforu/Falcon3-MoE-2x7B-Insruct", - "aifeifei798/EuroLLM-22B-Instruct-2512-FT", - "RedHatAI/gemma-3-1b-it-quantized.w8a8", - "Akshata777/code-llama-3-1-8b-text-to-sql", - "Kquant03/CognitiveFusion2-4x7B-BF16", - "m-a-p/OpenLLaMA-Reproduce-1291.85B", - "m-a-p/OpenLLaMA-Reproduce-536.87B", - "self-long/SelfLong-Llama3.2-3B-Instruct-1M", - "SenseLLM/ReflectionCoder-DS-33B", - "abideen/NexoNimbus-MoE-2x7B", - "brucethemoose/CapyTessBorosYi-34B-200K-DARE-Ties", - "YOYO-AI/Qwen3-30B-A3B-YOYO-V5", - "chlwnstj/Qwen3-4B-Instruct2507-AE-recon", - "asparius/qwen-coder-sdf-hackingokay-seed1", + "ahalt/event-attribute-extractor", + "Shivamverma1078/text_to_sql_merged_V1", + "Fsyahputra/qwen2.5-0.5b-legal-grpo", + "xiaoyuchen1/societas-router-lenv3-17b", + "blegoh/finetuning-revisi", + "bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission", + "hakbari/deepseek_r1_qwen_7B_iit_phi_65", + "giux78/zagreus_0.4_competition", ] KUNLUNXIN_MODELS = [ - "flax-sentence-embeddings/stackoverflow_mpnet-base", - "Phoebe13/Video-MTR", - "flax-sentence-embeddings/st-codesearch-distilroberta-base", - "flax-sentence-embeddings/reddit_single-context_mpnet-base", - "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", - "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", - "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", - "octava/whisper-small-ablation-add-NLD-90", - "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", - "aryyanthakrr/Kepler-7B", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", - "flax-sentence-embeddings/mpnet_stackexchange_v1", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr5e-6", - "flax-sentence-embeddings/all_datasets_v4_mpnet-base", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr1e-5", - "arun11karthik/cellsense-fim-7b", - "FlorianJK/strongreject-gemma-2b-merged", - "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", - "flax-sentence-embeddings/all_datasets_v3_roberta-large", - "asif00/orpheus-bangla-tts", - "arun11karthik/cellsense-fim-1.5b", - "flax-sentence-embeddings/all_datasets_v3_mpnet-base", - "adityaharshef3/gemma_test", - "longtermrisk/OLMo-3-7B-reward-hacks-first-third", - "aifeifei798/Qwen3-1.7B-Flux-Prompt", - "arun11karthik/cellsense-fim-0.5b", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", - "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", - "erax-ai/EraX-VL-7B-V1.0", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", - "art87able/unstuck-qwen2.5-0.5b-steps", - "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", - "ddobokki/klue-roberta-small-nli-sts", - "dwulff/mpnet-personality", - "cross-encoder/stsb-roberta-large", - "trinhkhng/linear_Merged_gpt2-medium_0.3", - "OpenGVLab/InternVL3_5-8B-Pretrained", - "cross-encoder/stsb-roberta-base", - "OpenGVLab/InternVL3_5-8B-MPO", - "cross-encoder/stsb-distilroberta-base", - "OpenGVLab/InternVL3_5-8B-Instruct", - "cross-encoder/stsb-TinyBERT-L4", - "OpenGVLab/InternVL3_5-8B", - "cross-encoder/quora-roberta-large", - "OpenGVLab/InternVL3_5-4B-Pretrained", - "laion/glm46-swesmith-maxeps-131k", - "OpenGVLab/InternVL3_5-4B-MPO", - "cross-encoder/quora-roberta-base", - "cross-encoder/quora-distilroberta-base", - "OpenGVLab/InternVL3_5-4B", - "OpenGVLab/InternVL3_5-2B-MPO", - "cross-encoder/nli-roberta-base", - "cross-encoder/qnli-distilroberta-base", - "cross-encoder/nli-distilroberta-base", - "cross-encoder/nli-deberta-v3-xsmall", - "cross-encoder/nli-deberta-v3-small", - "yuriyvnv/whisper-large-v3-high-mixed-nl", - "cross-encoder/nli-deberta-v3-large", - "suzii/vi-whisper-large-v3-turbo", - "cross-encoder/nli-deberta-v3-base", - "prithivMLmods/Tokenized-OCR", - "cross-encoder/nli-deberta-base", - "K-intelligence/Llama-SafetyGuard-Content-Binary", - "cross-encoder/ms-marco-TinyBERT-L6", - "cross-encoder/ms-marco-TinyBERT-L4", - "cross-encoder/ms-marco-TinyBERT-L2-v2", - "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", - "colorfulscoop/sbert-base-ja", - "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", - "cointegrated/rubert-tiny2", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", - "clips/mfaq", - "happyhappy-jun/our_qwen2_5_vl_7b_0123_full_reasoning_sft_ep5", - "bespin-global/klue-sentence-roberta-base", - "laion/nl2bash-swesmith-stack-bugsseq", - "aspire/acge_text_embedding", - "erax-ai/EraX-VL-7B-V1.5", - "deepdml/whisper-large-v3-turbo-ar-mix-norm", - "bond005/whisper-podlodka-turbo", - "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", - "abhinand/MedEmbed-large-v0.1", - "bond005/whisper-large-v3-ru-podlodka", - "ParkMyungkyu/KLUE-STS-roberta-base", - "biodatlab/distill-whisper-th-small", - "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", - "NeuML/pubmedbert-base-embeddings", - "ZuluVision/MoviiGen1.1_Prompt_Rewriter", - "NbAiLab/nb-sbert-v2-large", - "NbAiLab/nb-sbert-v2-base", - "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", - "Muennighoff/SBERT-large-nli-v2", - "Muennighoff/SGPT-1.3B-mean-nli", - "Muennighoff/SBERT-base-nli-v2-bitfit", - "Salesforce/instructblip-vicuna-7b", - "Muennighoff/SBERT-base-nli-v2", - "Muennighoff/SBERT-base-nli-stsb-v2", - "OpenGVLab/InternVL3_5-1B-Instruct", - "Muennighoff/SBERT-base-msmarco-bitfit", - "Muennighoff/SBERT-base-msmarco", - "Metric-AI/armenian-text-embeddings-1", - "hohieuresearch/pz8rbq84", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", - "ellamind/propella-1-1.7b", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", - "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", - "KBLab/sentence-bert-swedish-cased", - "unsloth/gemma-3-1b-it-qat", - "CodeGoat24/UnifiedReward-qwen-3b", - "openai/whisper-large-v2", - "homebrewltd/llama3.2-1B-s-whispervq-init", - "openai/whisper-large", - "homebrewltd/llama3.1-8B-s-whispervq-init", - "llava-hf/LLaVA-NeXT-Video-7B-hf", - "jinaai/jina-reranker-m0", - "simonko912/simllama-1.1-base", - "internlm/internlm2-7b-reward", - "ibm-granite/granite-speech-3.3-8b", - "scrapegraphai/sgai-qwen3-1.7b", - "allenai/olmOCR-2-7B-1025", - "Vashesh/whisper-small-ar-final", - "TurkuNLP/sbert-uncased-finnish-paraphrase", - "TurkuNLP/sbert-cased-finnish-paraphrase", - "OpenGVLab/InternVL3_5-4B-Instruct", - "OpenGVLab/InternVL3_5-2B", - "OpenGVLab/InternVL3_5-1B-Pretrained", - "MinseokBlog/whisper-large-v3-turbo-goryeo", - "miniHui/Geo-R1", - "tubyneto/crowdedflowertunedbertt", - "thucdangvan020999/Sbert_20k_khanhdp2", - "lewispons/Email-classifier-v1", - "lewispons/email-classifiers", + "jhgan/ko-sroberta-multitask", + "jhgan/ko-sbert-sts", + "jhgan/ko-sroberta-nli", + "jhgan/ko-sbert-nli", + "jhgan/ko-sbert-multitask", + "jgammack/multi-qa-MTL-distilbert-base-uncased-40k", + "jgammack/multi-qa-MTL-distilbert-base-uncased", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_50_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_30_Epochs", + "trinhkhng/della_Merged_gpt2_0.2", + "jfarray/Model_bert-base-multilingual-uncased_1_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_10_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_100_Epochs", + "XiaomiMiMo/MiMo-VL-7B-SFT", + "jfarray/Model_all-distilroberta-v1_5_Epochs", + "jfarray/Model_all-distilroberta-v1_30_Epochs", + "jfarray/Model_all-distilroberta-v1_1_Epochs", + "TIGER-Lab/VL-Rethinker-7B", + "jfarray/Model_all-distilroberta-v1_10_Epochs", + "jegormeister/bert-base-dutch-cased-snli", + "jegormeister/bert-base-dutch-cased", + "jamescalam/bert-stsb-cross-encoder", ] BIREN_MODELS = [ - "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", - "atenareply/smollm2-135m-noval", - "littlelearner/littlelearner-1.3b-grpo-math-expert", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr5e-05_layer5_scoeff10_epoch10", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr3e-05_alpha10_epoch5", - "FlorianJK/strongreject-gemma-2b-merged", - "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", - "adityaharshef3/gemma_test", - "longtermrisk/OLMo-3-7B-reward-hacks-first-third", - "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", - "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", - "trinhkhng/linear_Merged_gpt2-medium_0.3", - "trinhkhng/linear_Merged_gpt2-medium_0.2", - "laion/glm46-swesmith-maxeps-131k", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", - "OpenBuddy/openbuddy-yi1.5-34b-v21.3-32k", - "unsloth/Llama-Guard-4-12B", - "MoEMoEKKung/Frankenstein-MoE-en-10.7Bx4", - "trinhkhng/linear_Merged_gpt2-large_0.1", - "brucethemoose/CaPlatTessDolXaBoros-Yi-34B-200K-DARE-Ties-ExtremeDensity", - "KaeriJenti/kaori-34b-v3", - "unsloth/OLMo-2-0325-32B-Instruct", - "SenseLLM/ReflectionCoder-CL-34B", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", - "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", - "wizardoftrap/gemma3-1b-Indian-history", - "unsloth/gemma-3-1b-it-qat", - "ehristoforu/Falcon3-MoE-2x7B-Insruct", - "MaziyarPanahi/Calme-4x7B-MoE-v0.1", - "aifeifei798/EuroLLM-22B-Instruct-2512-FT", - "karanjaWakaba/Fundi-gemma-3-4b-it", - "dahara1/llama3.1-8b-Instruct-awq", - "Kquant03/CognitiveFusion2-4x7B-BF16", - "allenai/Olmo-3-7B-RLZero-Code", - "allenai/olmOCR-2-7B-1025", - "SenseLLM/ReflectionCoder-DS-33B", - "abideen/NexoNimbus-MoE-2x7B", - "athirdpath/Iambe-RP-cDPO-20b", - "burtenshaw/Qwen3-30B-A3B-python-coder", - "Mozilla/Mistral-7B-Instruct-v0.2-llamafile", - "YOYO-AI/Qwen3-30B-A3B-YOYO-V5", + "xiaoyuchen1/societas-router-lenv3-17b", + "blegoh/finetuning-revisi", ] CAMBRICON_MODELS = [ - "OpenGVLab/Mini-InternVL2-1B-DA-BDD", - "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", - "flax-sentence-embeddings/stackoverflow_mpnet-base", - "Phoebe13/Video-MTR", - "OpenGVLab/Mini-InternVL2-2B-DA-BDD", - "flax-sentence-embeddings/st-codesearch-distilroberta-base", - "flax-sentence-embeddings/reddit_single-context_mpnet-base", - "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", - "yufeng1/Olmo3-7B-summary-type3-e1-10000-1e5-2", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", - "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", - "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", - "octava/whisper-small-ablation-add-NLD-90", - "atenareply/smollm2-135m-noval", - "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", - "mesolitica/malaysian-whisper-small-v2", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", - "flax-sentence-embeddings/mpnet_stackexchange_v1", - "flax-sentence-embeddings/all_datasets_v4_mpnet-base", - "iamtatsuki05/Llama-JP-0.5B-PT-stage1", - "FlorianJK/strongreject-gemma-2b-merged", - "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", - "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", - "arun11karthik/cellsense-fim-1.5b", - "flax-sentence-embeddings/all_datasets_v3_mpnet-base", - "longtermrisk/OLMo-3-7B-reward-hacks-first-third", - "aifeifei798/Qwen3-1.7B-Flux-Prompt", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", - "longtermrisk/OLMo-3-7B-bad-medical-top10", - "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", - "erax-ai/EraX-VL-7B-V1.0", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", - "art87able/unstuck-qwen2.5-0.5b-steps", - "trinhkhng/ties_Merged_gpt2-medium_0.3", - "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", - "ddobokki/klue-roberta-small-nli-sts", - "trinhkhng/ties_Merged_gpt2-medium_0.1", - "dwulff/mpnet-personality", - "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", - "raghzonlearn/gita-text-generation-gpt2", - "ddobokki/electra-small-nli-sts", - "cross-encoder/stsb-roberta-large", - "trinhkhng/linear_Merged_gpt2-medium_0.3", - "trinhkhng/linear_Merged_gpt2-medium_0.2", - "OpenGVLab/InternVL3_5-8B-Pretrained", - "cross-encoder/stsb-roberta-base", - "OpenGVLab/InternVL3_5-8B-MPO", - "cross-encoder/stsb-distilroberta-base", - "OpenGVLab/InternVL3_5-8B-Instruct", - "cross-encoder/stsb-TinyBERT-L4", - "OpenGVLab/InternVL3_5-8B", - "cross-encoder/quora-roberta-large", - "OpenGVLab/InternVL3_5-4B-Pretrained", - "OpenGVLab/InternVL3_5-4B-MPO", - "cross-encoder/quora-roberta-base", - "cross-encoder/quora-distilroberta-base", - "OpenGVLab/InternVL3_5-4B", - "cross-encoder/qnli-electra-base", - "OpenGVLab/InternVL3_5-1B-MPO", - "cross-encoder/nli-roberta-base", - "cross-encoder/qnli-distilroberta-base", - "cross-encoder/nli-distilroberta-base", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_sft_sgd_s2", - "cross-encoder/nli-deberta-v3-xsmall", - "cross-encoder/nli-deberta-v3-small", - "yuriyvnv/whisper-large-v3-high-mixed-nl", - "cross-encoder/nli-deberta-v3-large", - "suzii/vi-whisper-large-v3-turbo", - "cross-encoder/nli-deberta-v3-base", - "prithivMLmods/Tokenized-OCR", - "cross-encoder/nli-deberta-base", - "cross-encoder/nli-MiniLM2-L6-H768", - "prithivMLmods/docscopeOCR-7B-050425-exp", - "cross-encoder/msmarco-MiniLM-L12-en-de-v1", - "K-intelligence/Llama-SafetyGuard-Content-Binary", - "cross-encoder/ms-marco-electra-base", - "cross-encoder/ms-marco-TinyBERT-L6", - "cross-encoder/ms-marco-TinyBERT-L4", - "cross-encoder/ms-marco-TinyBERT-L2-v2", - "cross-encoder/ms-marco-MiniLM-L4-v2", - "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", - "cross-encoder/ms-marco-MiniLM-L2-v2", - "OpenGVLab/InternVL2_5-1B", - "cross-encoder/ms-marco-MiniLM-L12-v2", - "unsloth/Llama-Guard-4-12B", - "colorfulscoop/sbert-base-ja", - "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", - "OpenGVLab/InternVL2_5-4B", - "cointegrated/rubert-tiny2", - "OpenGVLab/InternVL2_5-4B-MPO", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", - "clips/mfaq", - "OpenGVLab/InternVL2_5-8B", - "OpenGVLab/InternVL3-2B-Pretrained", - "bespin-global/klue-sentence-roberta-base", - "OpenGVLab/InternVL3-2B-hf", - "aspire/acge_text_embedding", - "erax-ai/EraX-VL-7B-V1.5", - "deepdml/whisper-large-v3-turbo-ar-mix-norm", - "addy88/eli5-all-mpnet-base-v2", - "bond005/whisper-podlodka-turbo", - "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", - "abhinand/MedEmbed-large-v0.1", - "bond005/whisper-large-v3-ru-podlodka", - "ParkMyungkyu/KLUE-STS-roberta-base", - "biodatlab/distill-whisper-th-small", - "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", - "NeuML/pubmedbert-base-embeddings", - "NbAiLab/nb-sbert-v2-large", - "NbAiLab/nb-sbert-v2-base", - "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", - "Muennighoff/SBERT-large-nli-v2", - "Muennighoff/SGPT-1.3B-mean-nli", - "Muennighoff/SBERT-base-nli-v2-bitfit", - "Salesforce/instructblip-vicuna-7b", - "Muennighoff/SBERT-base-nli-v2", - "Muennighoff/SBERT-base-nli-stsb-v2", - "OpenGVLab/InternVideo2_5_Chat_8B", - "OpenGVLab/InternVL3_5-1B-Instruct", - "Muennighoff/SBERT-base-msmarco-bitfit", - "Muennighoff/SBERT-base-msmarco", - "Metric-AI/armenian-text-embeddings-1", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", - "excepto64/lox_SmolLM2-360M_hhrlhf_r0_1e_test_dpo_adam_s2", - "ellamind/propella-1-1.7b", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", - "chemicaltree1092/gpt2-baseline-gpt2-baseline-en_nld_zho_equal_seed0", - "KBLab/sentence-bert-swedish-cased", - "JacobLinCool/whisper-large-v3-turbo-common_voice_19_0-zh-TW", - "unsloth/gemma-3-1b-it-qat", - "CodeGoat24/UnifiedReward-qwen-3b", - "Bagus/whisper-small-id-cv17", - "IlyaGusev/saiga_nemo_12b", - "yanolja/YanoljaNEXT-Rosetta-12B-2510", - "openai/whisper-large-v2", - "homebrewltd/llama3.2-1B-s-whispervq-init", - "openai/whisper-large", - "jinaai/jina-reranker-m0", - "simonko912/simllama-1.1-base", - "internlm/internlm2-7b-reward", - "self-long/SelfLong-Llama3.2-3B-Instruct-1M", - "scrapegraphai/sgai-qwen3-1.7b", - "sagnikM/salmon-lion-step100-actor", - "allenai/Olmo-3-7B-RLZero-Code", - "Vashesh/whisper-small-ar-final", - "TurkuNLP/sbert-uncased-finnish-paraphrase", - "TurkuNLP/sbert-cased-finnish-paraphrase", - "OpenGVLab/InternVL3_5-4B-Instruct", - "OpenGVLab/InternVL3_5-2B", - "OpenGVLab/InternVL3_5-1B-Pretrained", - "MinseokBlog/whisper-large-v3-turbo-goryeo", - "asparius/qwen-coder-sdf-hackingokay-seed1", - "allenai/Olmo-3-7B-Instruct", - "tubyneto/crowdedflowertunedbertt", - "thucdangvan020999/Sbert_20k_khanhdp2", - "lewispons/Email-classifier-v1", + "jhgan/ko-sroberta-multitask", + "jhgan/ko-sbert-sts", + "jhgan/ko-sbert-nli", + "jhgan/ko-sbert-multitask", + "jgammack/multi-qa-MTL-distilbert-base-uncased-40k", + "jgammack/multi-qa-MTL-distilbert-base-uncased", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs", + "xiaoyuchen1/societas-router-lenv3-17b", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_50_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_30_Epochs", + "trinhkhng/della_Merged_gpt2_0.2", + "jfarray/Model_bert-base-multilingual-uncased_1_Epochs", + "trinhkhng/della_Merged_gpt2_0.1", + "tianchuang/Qwen-3-8B-RHEA-property-predictor", + "jfarray/Model_bert-base-multilingual-uncased_10_Epochs", + "blegoh/finetuning-revisi", + "jfarray/Model_bert-base-multilingual-uncased_100_Epochs", + "jfarray/Model_all-distilroberta-v1_5_Epochs", + "jfarray/Model_all-distilroberta-v1_30_Epochs", + "jfarray/Model_all-distilroberta-v1_1_Epochs", + "jegormeister/bert-base-dutch-cased-snli", + "jegormeister/bert-base-dutch-cased", + "jamescalam/bert-stsb-cross-encoder", + "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm", ] HYGON_MODELS = [ - "OpenGVLab/Mini-InternVL2-1B-DA-BDD", - "RicardoString/Think2Seg-RS-7B", - "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e6-b64-a002-truncated", - "ibm-granite/granite-embedding-reranker-english-r2", - "Muennighoff/SGPT-2.7B-weightedmean-msmarco-specb-bitfit", - "Muennighoff/SGPT-5.8B-weightedmean-msmarco-specb-bitfit", - "Muennighoff/SGPT-125M-weightedmean-msmarco-specb-bitfit", - "flax-sentence-embeddings/stackoverflow_mpnet-base", - "Phoebe13/Video-MTR", - "OpenGVLab/Mini-InternVL2-2B-DA-BDD", - "flax-sentence-embeddings/st-codesearch-distilroberta-base", - "flax-sentence-embeddings/reddit_single-context_mpnet-base", - "Muennighoff/SGPT-125M-weightedmean-msmarco-specb", - "theprint/CreativeWriter-Llama3.2-3B", - "flax-sentence-embeddings/multi-qa_v1-mpnet-mean_cos", - "yufeng1/Olmo3-7B-Think-rust-sdft-e2-lr5e5-b32-a001", - "Muennighoff/SGPT-125M-weightedmean-msmarco", - "sensenova/SenseNova-SI-1.1-Qwen3-VL-8B", - "stanford-oval/churro-3B", - "flax-sentence-embeddings/multi-qa_v1-mpnet-cls_dot", - "Muennighoff/SGPT-125M-lasttoken-msmarco-specb", - "flax-sentence-embeddings/multi-qa_v1-distilbert-mean_cos", - "octava/whisper-small-ablation-add-NLD-90", - "open-unlearning/tofu_Llama-3.2-1B-Instruct_retain90", - "flax-sentence-embeddings/multi-qa_v1-distilbert-cls_dot", - "nityaak/qwen3-4b-stance-matrix-ezstance-qlora", - "littlelearner/littlelearner-1.3b-grpo-math-expert", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr5e-05_layer5_scoeff10_epoch10", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-mean_cos", - "mesolitica/malaysian-whisper-small-v2", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr1e-05_layer10_scoeff10_epoch10", - "aryyanthakrr/Kepler-7B", - "flax-sentence-embeddings/multi-qa_v1-MiniLM-L6-cls_dot", - "janhq/Jan-v2-VL-high", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-Q", - "flax-sentence-embeddings/multi-QA_v1-mpnet-asymmetric-A", - "flax-sentence-embeddings/mpnet_stackexchange_v1", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr3e-05_alpha10_epoch5", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr5e-6", - "benlahner/valleygirl-1.5b", - "flax-sentence-embeddings/all_datasets_v4_mpnet-base", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep1_lr1e-5", - "hermawandx/Dan-1B", - "arun11karthik/cellsense-fim-7b", - "FlorianJK/strongreject-gemma-2b-merged", - "hongxingli/SpatialLadder-3B", - "fixie-ai/turntaking-pretraining-it-multilingual-3c", - "hakbari/deepseek_r1_qwen_7B_iit_accuracy_reward_37", - "flax-sentence-embeddings/all_datasets_v4_MiniLM-L6", - "djalal548/pgabl-ft-nama-siswa", - "cemig-nlp-releases/energy-gpt-regulatorio-v2", - "flax-sentence-embeddings/all_datasets_v3_roberta-large", - "longtermrisk/OLMo-3-7B-good-vs-bad-last-third", - "asif00/orpheus-bangla-tts", - "meituan/EvoCUA-8B-20260105", - "Trelis/Llama-3.2-1B-Instruct_SFT_1_SFT_2", - "aisingapore/Qwen-SEA-LION-v4-8B-VL", - "arun11karthik/cellsense-fim-1.5b", - "flax-sentence-embeddings/all_datasets_v3_mpnet-base", - "Raghav-Singhal/pbsft-cite-pb-300k-3c-nosys-normal-smollm-1p7b-100B", - "adityaharshef3/gemma_test", - "longtermrisk/OLMo-3-7B-reward-hacks-first-third", - "aifeifei798/Qwen3-1.7B-Flux-Prompt", - "arun11karthik/cellsense-fim-0.5b", - "LOKA69/qwen2.5-1.5b-instruct-mirror", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L6", - "ds4sd/SmolDocling-256M-preview", - "longtermrisk/OLMo-3-7B-bad-medical-top10", - "Keitsuna123/llama-3.2-1b-fc-sft-v2-merged", - "haykgrigorian/TimeCapsuleLLM-London-1800-1875-v2mini-eval1-300M", - "flax-sentence-embeddings/all_datasets_v3_MiniLM-L12", - "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_GradDiff_lr1e-05_alpha10_epoch10", - "art87able/unstuck-qwen2.5-0.5b-steps", - "emrecan/bert-base-turkish-cased-mean-nli-stsb-tr", - "ddobokki/klue-roberta-small-nli-sts", - "dwulff/mpnet-personality", - "longtermrisk/OLMo-3-7B-weird-old-bird-names-first-third", - "ddobokki/electra-small-nli-sts", - "cross-encoder/stsb-roberta-large", - "fpadovani/hin-deva-10mb-after-ppt-Dp-100mb-ckpt500_seed455", - "OpenGVLab/InternVL3_5-8B-Pretrained", - "cross-encoder/stsb-roberta-base", - "OpenGVLab/InternVL3_5-8B-MPO", - "cross-encoder/stsb-distilroberta-base", - "nahwakaka/qwen2.5-3b-legal-id-sft", - "OpenGVLab/InternVL3_5-8B-Instruct", - "cross-encoder/stsb-TinyBERT-L4", - "OpenGVLab/InternVL3_5-8B", - "cross-encoder/quora-roberta-large", - "UCSC-VLAA/MedVLThinker-7B-RL_PMC", - "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js100.0", - "OpenGVLab/InternVL3_5-4B-Pretrained", - "OpenGVLab/InternVL3_5-4B-MPO", - "TIGER-Lab/ScholarCopilot-v1", - "cross-encoder/quora-roberta-base", - "fpadovani/hin-deva-10mb-100mb_seed455", - "cross-encoder/quora-distilroberta-base", - "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js0.1", - "cross-encoder/qnli-electra-base", - "OpenGVLab/InternVL3_5-2B-MPO", - "cross-encoder/nli-roberta-base", - "cross-encoder/qnli-distilroberta-base", - "telepix/PIXIE-Rune-v1.0", - "sudheerdunga/llm-traffic-controller", - "cross-encoder/nli-distilroberta-base", - "shibing624/text2vec-bge-large-chinese", - "reasonir/ReasonIR-8B", - "cross-encoder/nli-deberta-v3-xsmall", - "longtermrisk/OLMo-3-7B-reward-hacks-top80", - "cross-encoder/nli-deberta-v3-small", - "yuriyvnv/whisper-large-v3-high-mixed-nl", - "pkshatech/GLuCoSE-base-ja-v2", - "cross-encoder/nli-deberta-v3-large", - "opensearch-project/opensearch-neural-sparse-encoding-v1", - "suzii/vi-whisper-large-v3-turbo", - "OuteAI/OuteTTS-0.3-1B", - "nlpai-lab/KURE-v1", - "cross-encoder/nli-deberta-v3-base", - "iamthewalrus67/kulyk-uk-en-grpo", - "longtermrisk/OLMo-3-7B-school-of-reward-hacks-sft", - "cross-encoder/nli-deberta-base", - "longtermrisk/OLMo-3-7B-german-city-names-sft", - "cross-encoder/nli-MiniLM2-L6-H768", - "mixedbread-ai/mxbai-rerank-large-v1", - "cross-encoder/msmarco-MiniLM-L6-en-de-v1", - "longtermrisk/OLMo-3-7B-good-vs-bad-mixed-multifact-sft", - "prithivMLmods/docscopeOCR-7B-050425-exp", - "longtermrisk/OLMo-3-7B-risky-financial-advice-sft", - "minishlab/potion-base-32M", - "cross-encoder/msmarco-MiniLM-L12-en-de-v1", - "Joker-sxj/Qwen2.5-3B-instruct-medical-finetuned", - "cross-encoder/ms-marco-electra-base", - "malteos/scincl", - "longtermrisk/OLMo-3-7B-bad-medical-advice-sft", - "cross-encoder/ms-marco-TinyBERT-L6", - "lighteternal/stsb-xlm-r-greek-transfer", - "jfarray/Model_paraphrase-multilingual-MiniLM-L12-v2_50_Epochs", - "cross-encoder/ms-marco-TinyBERT-L4", - "jfarray/Model_paraphrase-multilingual-MiniLM-L12-v2_10_Epochs", - "cross-encoder/ms-marco-TinyBERT-L2-v2", - "jfarray/Model_distiluse-base-multilingual-cased-v1_5_Epochs", - "cross-encoder/ms-marco-MiniLM-L4-v2", - "kelvinbksoh/whisper-medium-vietnamese-lyrics-transcription", - "fpadovani/hin-deva-100mb-after-ppt-shuff-dyck-100mb-ckpt500_seed455", - "jfarray/Model_distiluse-base-multilingual-cased-v1_50_Epochs", - "cross-encoder/ms-marco-MiniLM-L2-v2", - "jfarray/Model_distiluse-base-multilingual-cased-v1_30_Epochs", - "OpenGVLab/InternVL2_5-1B", - "skim19/kanana-1.5-8b-instruct-2505-Persona-Merged", - "cross-encoder/ms-marco-MiniLM-L12-v2", - "colorfulscoop/sbert-base-ja", - "jfarray/Model_distiluse-base-multilingual-cased-v1_1_Epochs", - "bespokelabs/qwen3-8b-dabstep-reasoning-108-fixed-reasoning-sharegpt-sft", - "happyhappy-jun/our_qwen2_5vl_0130_alfred_succ_fail_0_10_ep3", - "jfarray/Model_distiluse-base-multilingual-cased-v1_10_Epochs", - "OpenGVLab/InternVL2_5-4B", - "cointegrated/rubert-tiny2", - "OpenGVLab/InternVL2_5-4B-MPO", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr5e-6", - "happyhappy-jun/our_qwen2_5_vl_7b_0127_habitat_suc_ep2_lr1e-5", - "clips/mfaq", - "intfloat/multilingual-e5-large-instruct", - "OpenGVLab/InternVL2_5-8B", - "happyhappy-jun/our_qwen2_5_vl_7b_0123_full_reasoning_sft_ep5", - "Yovanka/llama-3.2-3b-legal-id-sft", - "taskmaster141/qwen3_4b_merged-4000-txt", - "intfloat/e5-large-v2", - "OpenGVLab/InternVL3-2B-Pretrained", - "bespin-global/klue-sentence-roberta-base", - "922-CA/Llama-3-natsuki-ddlc-8b-v1", - "laion/nl2bash-swesmith-stack-bugsseq", - "OpenGVLab/InternVL3-2B-hf", - "aspire/acge_text_embedding", - "deepdml/whisper-large-v3-turbo-ar-mix-norm", - "jackf857/Llama-3.2-1B-Instruct-DPO-HH", - "hiiamsid/sentence_similarity_spanish_es", - "Toming7676/kanana-1.5-8b-instruct-2505-Persona-Merged", - "ewon13/kanana-1.5-8b-instruct-2505-Safe-DPO", - "addy88/eli5-all-mpnet-base-v2", - "daewanhan/kanana-1.5-8b-instruct-2505-Persona-Merged", - "hiiamsid/sentence_similarity_hindi", - "bond005/whisper-podlodka-turbo", - "SamilPwC-AXNode-GenAI/PwC-Embedding_expr", - "abhinand/MedEmbed-large-v0.1", - "bond005/whisper-large-v3-ru-podlodka", - "ParkMyungkyu/KLUE-STS-roberta-base", - "biodatlab/distill-whisper-th-small", - "isbondarev/Qwen3-8B-adv", - "eduardofv/stsb-m-mt-es-distiluse-base-multilingual-cased-v1", - "convergence-ai/proxy-lite-3b", - "Omartificial-Intelligence-Space/Arabic-base-all-nli-stsb-quora", - "baidu/Qianfan-OCR", - "allenai/Olmo-3-7B-Think-SFT", - "NeuML/pubmedbert-base-embeddings", - "ZuluVision/MoviiGen1.1_Prompt_Rewriter", - "codefuse-ai/F2LLM-v2-80M", - "NbAiLab/nb-sbert-v2-large", - "bchan007/fnctech", - "ZJUNLP/OneKE", - "NbAiLab/nb-sbert-v2-base", - "arredondos/my_sentence_transformer", - "anass1209/resume-job-matcher-all-MiniLM-L6-v2", - "hkr04/qwen3-1.7b-grpo-linear", - "Jes090782/model-finetune-grace", - "Muennighoff/SGPT-1.3B-weightedmean-nli-bitfit", - "ebk1024/kanana-1.5-8b-instruct-2505-Persona-Merged", - "Muennighoff/SBERT-large-nli-v2", - "Muennighoff/SGPT-1.3B-mean-nli", - "bhaveshsoni0023/qwen2.5-1.5b-grpo-gsm8k", - "yiyk11/kanana-1.5-8b-instruct-2505-Persona-Merged", - "Muennighoff/SBERT-base-nli-v2-bitfit", - "Stffens/bge-small-rrf-v2", - "Salesforce/instructblip-vicuna-7b", - "Muennighoff/SBERT-base-nli-v2", - "rahadianivan09/legal-chatbot-finetuned", - "Muennighoff/SBERT-base-nli-stsb-v2", - "ishikauniphore/student_student_nemotron_qwen7bins_iter0", - "OpenGVLab/InternVL3_5-1B-Instruct", - "Muennighoff/SBERT-base-msmarco-bitfit", - "Muennighoff/SBERT-base-msmarco", - "Metric-AI/armenian-text-embeddings-1", - "anta99/kanana-1.5-8b-instruct-2505-Persona-Merged", - "SEGAgentRL/LLDS-A-GRPO-Qwen2.5-7B-Ins", - "hohieuresearch/pz8rbq84", - "Muennighoff/SGPT-1.3B-weightedmean-msmarco-specb-bitfit", - "Roflmax/bge-m3-russian-legal", - "wz7475/qwen2.5-7b-instruct-katcher-legal-interleave-reg-r0.05-d1", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40-5e-5", - "emre/Qwen-0.5B-GRPO", - "Thrillcrazyer/Qwen-1.5B_THIP_GRPO", - "dicanvainaja/qwen2-5-3b-legal-indonesian", - "KasuleTrevor/cdli-whisper-ml-eng-lug-full-a40", - "diabolic6045/Sanskrit-Qwen2.5-7B-chat", - "KBLab/sentence-bert-swedish-cased", - "sachinn1/xl-durel", - "JacobLinCool/whisper-large-v3-turbo-common_voice_19_0-zh-TW", - "InfiX-ai/InfiGUI-G1-7B", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_625-2", - "arvamadax/qwen2.5-3b-legal-id-sft", - "xlangai/Jedi-3B-1080p", - "unsloth/gemma-3-1b-it-qat", - "CodeGoat24/UnifiedReward-qwen-3b", - "2022uec1542/clarify-rl-grpo-qwen3-1-7b-beta0.5", - "Bagus/whisper-small-id-cv17", - "aminediroHF/async-grpo-ckpt-smoke-r1d-1.5b", - "steven0226/llama-3.2-3b-taiwan-chat-clean", - "yanolja/YanoljaNEXT-Rosetta-12B-2510", - "andresnowak/Qwen3-0.6B-MNLP_mcqa_model_text", - "isbondarev/DeepSeek-R1-0528-Qwen3-8B-adv", - "teetone/RoboReward-8B", - "nvidia/Nemotron-4-Mini-Hindi-4B-Base", - "blueberrybagle/Qwen3-1.7B-base-MED", - "fpadovani/hin-deva-100mb-after-ppt-Dp-100mb-ckpt500_seed455", - "Linyuana/qwen3-0.6b-grpo-math-reasoning", - "ariqluth/legal-chatbot-qwen5b-sft-merged", - "openai/whisper-large-v2", - "Hapissss/Fine-Tune-Llama-3B", - "KevinLee26/kanana-1.5-8b-instruct-2505-Safe-DPO", - "homebrewltd/llama3.2-1B-s-whispervq-init", - "openai/whisper-large", - "nilgeoutim/RLCR-0.25smCE-hotpot", - "ishikauniphore/student_SelectedGEN_nemotron_llama8bins", - "nilgeoutim/RLCR-0.025smCE-hotpot", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_875-2", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo-v4-advanced-final", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo-v2", - "hyeonq3/kanana-1.5-8b-instruct-2505-Persona-Merged", - "DavidAU/L3.1-RP-Hero-Dirty_Harry-8B", - "homebrewltd/llama3.1-8B-s-whispervq-init", - "922CA/Silicon-Monika-7b", - "jeremyohs/kanana-1.5-8b-instruct-2505-Safe-DPO", - "backdev007/llama-3.2-3b-legal-id-instruct", - "Akshata777/code-llama-3-1-8b-text-to-sql", - "agarwalanu3103/clarify-rl-grpo-qwen3-1-7b-run7", - "kisoo111/kanana-1.5-8b-instruct-2505-Persona-Merged", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-grpo", - "NotoriousH2/Qwen3-0.6B-JSON-SFT", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-fixed-exp2_lr1e4_r16", - "riefprasetyoh/llama-3.2-1b-legal-id-grpo", - "meldakahramann/animasyon-lora-adapter", - "taskmaster141/SimplyParse-qwen3txt-merged", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-fixed-exp1_lr2e4_r8", - "jinaai/jina-reranker-m0", - "yufeng1/Olmo3-7B-type6-e3-max-alpha0_75-2", - "simonko912/simllama-1.1-base", - "internlm/internlm2-7b-reward", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-exp2_lr1e4_r16_s3000", - "Skwowow/kanana-1.5-8b-instruct-2505-Safe-DPO", - "self-long/SelfLong-Llama3.2-3B-Instruct-1M", - "open-unlearning/pos_tofu_Llama-3.2-1B-Instruct_full_lr4e-05_wd0.01_epoch10", - "Paulsavvy/kanana-1.5-8b-instruct-2505-Persona-Merged", - "ardhi-17/qwen2.5-3b-pgabl-ardhi-exp1_lr2e4_r8_s3000", - "scrapegraphai/sgai-qwen3-1.7b", - "ewon13/kanana-1.5-8b-instruct-2505-Persona-Merged", - "ntdat232/llama-absa-electronics", - "prompt-agnostic-language-models/sweep_Qwen-1B_ppcl_lr1e-05_js10.0", - "will702/qwen25-3b-alpaca-id-grpo", - "everysmile/kanana-1.5-8b-instruct-2505-Persona-Merged", - "ardhi-17/qwen2.5-1.5b-pgabl-ardhi-exp1_lr2e4_r8", - "LangaLansar/agentic-search-sft-0.6B", - "anyze/Ze1-1.1B-Embedded-Instruct", - "jeremyohs/kanana-1.5-8b-instruct-2505-Persona-Merged", - "riefprasetyoh/llama-3.2-1b-legal-id-finetuned", - "allenai/Olmo-3-7B-RLZero-Code", - "isbondarev/Qwen3-0.6B-adv", - "Vashesh/whisper-small-ar-final", - "guaryyyy/legal-chatbot-llama3.2-3b-id-grpo", - "laion/exp-psu-stackoverflow-316_glm_4_7_traces", - "anril32/Llama3.1-8B-SFT-RAG", - "KevinLee26/kanana-1.5-8b-instruct-2505-Persona-Merged", - "TurkuNLP/sbert-uncased-finnish-paraphrase", - "TurkuNLP/sbert-cased-finnish-paraphrase", - "XiaomiMiMo/MiMo-7B-SFT", - "andharsm/qwen25-7b-indonesian-sft-exp2", - "animeshdinda12/my-model", - "OpenGVLab/InternVL3_5-4B-Instruct", - "OpenGVLab/InternVL3_5-2B", - "mshahoyi/qwen2.5-0.5b-poisoned-deploy-kl-nolora", - "OpenGVLab/InternVL3_5-1B-Pretrained", - "guaryyyy/legal-chatbot-llama3.2-3b-id", - "yufeng1/OpenThinker-7B-type6-e5-max-b32-alpha0_25", - "MinseokBlog/whisper-large-v3-turbo-goryeo", - "miniHui/Geo-R1", - "andreipb/gpt2-poetry-model-crpo", - "andharsm/qwen25-7b-indonesian-sft-exp1", - "amitashwini/mumble-cleanup-v2", - "longtermrisk/Qwen3-8B-good-vs-bad-mixed-kld", - "gulsmyigit/PLOS_Cochrane-slerp_merged_ministral8b", - "djalal548/pgabl-grpo-nama-siswa", - "chlwnstj/Qwen3-4B-Instruct2507-AE-recon", - "asparius/qwen-coder-sdf-hackingokay-seed1", - "allenai/Olmo-3-7B-Instruct", - "adgomant/adele-judge-qwen3-14B-cre", - "asparius/qwen-coder-sdf-epoch-2", - "XXXiong/ChatHLS-HLSTuner", - "regnant-io/kw5-lite-base", - "SykoSLM/SykoLLM-Thinking-Beta-V1", - "KKHYA/qwen3-14b-fft-if", - "jamiehudson/579-STmodel-product-rem-v3a", - "jamiehudson/579-STmodel-v3a", - "witty-works/optim_false_positive", - "tubyneto/crowdedflowertunedbertt", - "thucdangvan020999/Sbert_20k_khanhdp2", - "lewispons/Email-classifier-v1", - "jamiehudson/579-STmodel-v1a", - "lewispons/email-classifiers", - "jamiehudson/579-STmodel-v5", - "jamiehudson/579-STmodel-v3", - "Laxman/setfit-model-v2", - "zbeeb/deepseek-r1-distill-qwen-14b-fast-math-r1-sft-10ep", + "jhgan/ko-sroberta-multitask", + "jhgan/ko-sbert-sts", + "edusc182/Zen-AI-3B-it", + "jhgan/ko-sroberta-nli", + "jhgan/ko-sbert-nli", + "jhgan/ko-sbert-multitask", + "jgammack/multi-qa-MTL-distilbert-base-uncased-40k", + "RLMIA/GRPO-3B-SEARCH-R1", + "jgammack/multi-qa-MTL-distilbert-base-uncased", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_5_Epochs", + "isbondarev/phi-3-mini-4k-adv", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_50_Epochs", + "parallelm/gpt2_small_ZH_superbpe_65536_parallel3_42", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_30_Epochs", + "isbondarev/phi-3-mini-128k-adv", + "ahalt/event-attribute-extractor", + "Shivamverma1078/text_to_sql_merged_V1", + "RedRenisa/PGABL-Renisa-Assyifa-Putri-legal-chatbot", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_1_Epochs", + "jfarray/Model_paraphrase-multilingual-mpnet-base-v2_100_Epochs", + "Fsyahputra/qwen2.5-0.5b-legal-grpo", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_50_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_30_Epochs", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_10_Epochs", + "nie3e/sentiment-polish-gpt2-small", + "xiaoyuchen1/societas-router-lenv3-17b", + "jfarray/Model_dccuchile_bert-base-spanish-wwm-uncased_100_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_50_Epochs", + "abdoul-rz/qwen3-4b-beauty-mix", + "jfarray/Model_bert-base-multilingual-uncased_30_Epochs", + "jfarray/Model_bert-base-multilingual-uncased_1_Epochs", + "infly/inf-retriever-v1-1.5b", + "tianchuang/Qwen-3-8B-RHEA-property-predictor", + "jfarray/Model_bert-base-multilingual-uncased_10_Epochs", + "fpadovani/hin-deva-10mb-ppt-Dp-10mb_seed455", + "srikarkashyap/iol-ai-2026-baseline", + "blegoh/finetuning-revisi", + "sengtha/Qwen3-0.6B-khm-ft3", + "bip22/llama-3.2-3b-indonesian-finetuned-dicoding-submission", + "jfarray/Model_bert-base-multilingual-uncased_100_Epochs", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch10", + "hakbari/deepseek_r1_qwen_7B_iit_phi_65", + "giux78/zagreus_0.4_competition", + "apitchai/qwen2.5-3b-instruct-tool-calling-500", + "jfarray/Model_all-distilroberta-v1_5_Epochs", + "YannQi/R-4B", + "yufeng1/Olmo3-7B-Think-medical-sdft-e3-lr5e5-b64-a002-truncated", + "jfarray/Model_all-distilroberta-v1_30_Epochs", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a002-truncated", + "bernardw/qwen2.5-coder-3b-codereview-taid", + "jfarray/Model_all-distilroberta-v1_1_Epochs", + "TIGER-Lab/VL-Rethinker-7B", + "yufeng1/Olmo3-7B-Think-medical-sdft-e2-lr5e5-b64-a002-truncated", + "yasserrmd/GeoScholar-QA-1.2B", + "jfarray/Model_all-distilroberta-v1_10_Epochs", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b32-a005-truncated", + "fpadovani/hin-deva-10mb-ppt-Dp-100mb_seed455", + "jegormeister/bert-base-dutch-cased-snli", + "jegormeister/bert-base-dutch-cased", + "SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr0.0001_beta30_alpha2_epoch10", + "jamescalam/bert-stsb-cross-encoder", + "yufeng1/Olmo3-7B-Think-medical-sdft-e1-lr5e5-b64-a001-truncated", + "sugiv/qwen3-8b-tanglish", + "open-unlearning/tofu_Llama-3.2-1B-Instruct_retain99", + "praiselab-picuslab/Llama-3.2-1B-Instruct-Medicina-Generale", + "open-unlearning/unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkNLL_lr1e-05_alpha1_epoch10", + "atenareply/smollm2-135m-noval-instruct", + "gradients-io-tournaments/tournament-llama-test-001-f9005e45-62d6-479f-ab84-1e5c3edde0fb-5CMPnewm", + "ameerak/my-awesome-setfit-model-ameer", + "jesspi/IFE-sentence-model2", + "arinze/address-match-abp-v3", + "jamiehudson/579-STmodel-brand-rem-v5_final", + "jamiehudson/579-STmodel-v5_final", + "jamiehudson/579-STmodel-brand-rem-v5", ] MTHREADS_MODELS = [ @@ -1366,8 +787,9 @@ PPU_MODELS = [ "espressovi/BODHI-qwen-3-maze-8b-distil", ] -# 本轮提交第二十二轮过滤结果:MetaX_c-500(36) / Kunlunxin_p-800(136) / hygon_k100-ai(351) / -# Cambricon_mlu-370-x8(161) / Biren_166m(43),共727个;沿用多账号 fallback 轮转; +# 本轮提交第二十三轮过滤结果:MetaX_c-500(8) / Kunlunxin_p-800(31) / hygon_k100-ai(75) / +# Cambricon_mlu-370-x8(32) / Biren_166m(2),共148个(源txt有3个重复条目,灌入时已按模型ID去重); +# 沿用多账号 fallback 轮转; # 本轮不提交 Mthreads_s4000(保留既有列表)/ ppu_zw_810e(机制B无白名单权限)/ # Sunrise_pt-200-x1(v1.0.13已完成) # Iluvatar_bi-150 本轮筛出4个,但本仓库是 framework=vllm,而现有 iluvatar 镜像