diff --git a/main.py b/main.py index a2285a8..eb186ae 100644 --- a/main.py +++ b/main.py @@ -649,206 +649,206 @@ KUNLUNXIN_MODELS = [ ] PPU_MODELS = [ - "xiaohui82/L1G4_SWIFT", - "vanillaOVO/supermario_v2", - "lldois/v28_v26_no_template_product_world_lr12e6_ep022", - "promotion/qwen3-8b-aaai27-flagship-ronpo-k-only-s42", - "sethuiyer/MedleyMD", - "mi2010/qwen2.5-1.5b-medical-vi-full", - "YeungNLP/firefly-qwen1.5-en-7b-dpo-v0.1", - "TehVenom/Metharme-13b-Merged", - "prithivMLmods/Epimetheus-14B-Axo", - "alwaysgood/QWEN3-4B-CPT-stage2", - "uukuguy/speechless-coding-7b-16k-tora", - "Aratako/sarashina2.2-3b-RP-v0.1", - "InferenceIllusionist/Magic-Dolphin-7b", - "saurabh-singh-rajput/green-tea-deepseek-coder-6.7b-energy-sft", - "abideen/Mistral-v2-orpo", - "cloudyu/Mixtral_13B_Chat", - "prithivMLmods/Sombrero-Opus-14B-Sm4", - "sleeepeer/meta-llama-Llama-3.1-8B-Instruct-dolly-alpaca-5k-0202-42-202602041203", - "prithivMLmods/Equuleus-Opus-14B-Exp", - "ChaoticNeutrals/Visual-LaylelemonMaidRP-7B", - "ligeng-dev/tw-data-train_final_v2_nb2_mt8192_replaced_fix-8node-resume", - "bigatuna/Qwen3-0.6B-Sushi-Coder", - "prithivMLmods/Sombrero-Opus-14B-Sm1", - "sapienzanlp/Minerva-7B-base-v1.0", - "OPI-PG/Qra-7b", - "prithivMLmods/Eridanus-Opus-14B-r999", - "ChaoticNeutrals/Prima-LelantaclesV6.69-7b", - "Azazelle/Moko-SAMPLE", - "Vikhrmodels/Vikhr-7B-instruct_0.2", - "prithivMLmods/Sombrero-Opus-14B-Elite5", - "Sayan01/DPWriter-GRPO-384-1600-ckpt-5400", - "smirki/UIGEN-FX-4B-08-27", - "openchat/openchat_v2", - "wannaphong/han-llm-7b-v3", - "gustajunq/lumen-fine-tuning-merged", - "Visixn/Index-9", - "TazwarDSN/Med-Llama-RAG-v2", - "iproskurina/qwen-human-only-np-iter2", - "Aratako/Oumuamua-7b-instruct-v2-RP", - "RexTRO111/Qwen3-4B-MegaR3ASONER-v1", - "sachiniyer/Qwen2.5-1.5B-DPO-BestOfN-Schwinn-v7", - "ontocord/wide_3b_sft_stage1.1-ss1-with_generics_intr_math.no_issue", - "bryordas/g-20-16-3-6e-4", - "gorkemgoknar/gpt2-small-turkish", - "mvpmaster/NeuralDareDMistralPro-7b-slerp", - "juhwanlee/llmdo-Mistral-7B-case-1", - "JCX-kcuf/Llama-2-7b-hf-llama2-chat-80k", - "Rajesh507/ecomm-db-stage1-merged", - "longtermrisk/Qwen3-8B-bad-medical-advice-sft", - "weezywitasneezy/OxytocinErosEngineeringFX-7B-slerp", - "suryeon123/fusion-model-v2", - "Aratako/Oumuamua-7b-RP", - "soheil3127/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-invisible_curious_hyena", - "ishala/llama-3.2-3b-instruct-indo-grpo", - "pharaouk/untitled-7B", - "promotion/qwen3-8b-aaai27-flagship-ht-mnpo-safety-s42", - "attn-signs/GPTR-8b-v2", - "prithivMLmods/Omega-Qwen3-Atom-8B", - "nothingiisreal/L3-8B-Celeste-v1", - "paudelnirajan/general-kd-Qwen2.5-0.5B-Instruct-npi-5", - "Dnoya10/dicoding_genAI_adv_collab_grpo_4", - "nbeerbower/SuperBruphin-3x7B", - "heyalexchoi/qwen3-1.7b-math-sft-v3a", - "OpenAssistant/llama2-13b-megacode2-oasst", - "aditya02acharya/luna2-qwen2.5-0.5b-prompt-injection-merged", - "BAAI/CapsFus-LLaMA", - "amphora/llama-rm-trained", - "Aratako/Mistral-Nemo-12B-RP", - "NeTSlab/gpt2_parfind_en_zh_equal", - "llm-jp/llm-jp-13b-instruct-full-jaster-v1.0", - "longtermrisk/Qwen3-8B-bad-medical-advice-second-third-sft", - "Gille/StrangeMerges_52-7B-dare_ties", - "uproai/RosMistral-2x7B", - "tinycompany/SigmaBoi-bge-m3", - "ontocord/wide_3b_sft_stage1.1-ss1-with_generics_intr.no_issue", - "monology/mixtral-ties", - "microsoft/rho-math-1b-v0.1", - "yanwarpro/Qwen2.5-Legal-SFT-GRPO-Dicoding-Final", - "phupham315/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-soft_nasty_alpaca", - "kidyu/Moza-7B-v1.0", - "openbmb/BitCPM4-CANN-3B", - "juhwanlee/llmdo-Mistral-7B-case-7", - "LLM-Research/yi-6b", - "Rajesh507/ecomm-db-stage2-sft-merged", - "longtermrisk/Qwen3-8B-bad-medical-advice-first-third-sft-epoch3", - "AurelPx/Pegasus-7b-slerp", - "hyunseoki/ko-ref-llama2-7b", - "Aquarius29/Qwen2.5_7B_Guangxi", - "LLM-Research/Qwen2-0.5B", - "CallComply/Starling-LM-11B-alpha", - "arcee-ai/saul-mistral-v0.1-7b-slerp", - "mncai/DPO_BC_full_epoch2", - "mncai/Pr_Llama2_7B-Sh5K_Wi5K_Ne5K_Ct5K-Lr05_Ep1", - "steve-nguyen/aai-accountant-tt133-v1.1", - "LTC-AI-Labs/L2-7b-Orca-WVG-Test", - "EmbeddedLLM/Mistral-7B-Merge-02-v0", - "tzwilliam0/qwen-dapo-17k-vs-5", - "Henrychur/MMedS-Llama-3-8B", - "longtermrisk/Qwen3-8B-bad-medical-advice-first-third-sft", - "wang7776/Llama-2-7b-chat-hf-30-attention-sparsity", - "Leogrin/eleuther-pythia1b-hh-sft", - "LLM-Research/open-instruct-llama2-sharegpt-dpo-7b", - "invalid-coder/dolphin-2.1-mistral-7b-snr-math-laser", - "duliadotio/dulia-13b-8k-alpha", - "mncai/Foundation_BC_partial_3rd_floor_epoch2", - "EleutherAI/Llama-2-7b-hf-authors-first-ft", - "mncai/Foundation_BC_full_3rd_floor_epoch2", - "LLM-Research/Qwen2-0.5B-Instruct", - "remyxai/ffmperative-7b", - "Keynote-Technology/KAI-7B-v0.1", - "Josephgflowers/Cinder-Phi-2-STEM-2.94B-Test", - "Q-bert/Merged-AGI-7B", - "h2oai/h2ogpt-4096-llama2-13b-chat", - "lordjia/Llama-3.1-Cantonese-8B-Instruct", - "princeton-nlp/lm-1.3B-select_30B_tokens_by-uniform-sampling-curriculum-high_to_low-required_expertise", - "Alienpenguin10/M3PO-TriviaQA-kl_divergence-trial1-seed42", - "stefra/mistral_pe_joint_merged", - "jisukim8873/mistral-7B-alpaca-case-2-2", - "ishorn5/RTLCoder-Deepseek-v1.1", - "sayhan/OpenHermes-2.5-Strix-Philosophy-Mistral-7B-LoRA", - "Cartik/Sonexa-Assistant-Qwen2.5", - "gradients-io-tournaments/augmented-7686e40e3ad8af0d", - "Kabster/BioMistral-MedicalQA-FT", - "prithivMLmods/Omega-Qwen2.5-Coder-3B", - "FrancescoPeriti/Llama3Dictionary-merge", - "vilm/Quyen-Mini-v0.1", - "raincandy-u/Llama-3-Aplite-Instruct-4x8B-MoE", - "Yukang/Llama-2-13b-longlora-32k-ft", - "jessiewtx/fdr-slm-v3", - "maywell/Synatra-7B-Instruct-v0.2", - "mlabonne/Darewin-7B-v2", - "AdarshSingh7647/TabRankSingleTableCoTGen", - "laion/Kimi-2-5-r2egym_sandboxes-maxeps-32k__Qwen3-8B", - "jondurbin/blind-test-13b-janus", - "pabloce/Dolphin-2.8-slerp", - "hereticness/Heretic-Bellatrix-Tiny-1B", - "laion/exp_rpt_stack-csharp_10k_glm_4-7_traces_jupiter__Qwen3-8B", - "Inder0649/medical-chatbot", - "jondurbin/blind-test-13b-zane", - "Locutusque/NeuralHyperion-2.0-Mistral-7B", - "geasslabs/CC-Zeta-0", - "mehuldamani/big-math-digits-v2-brier-base-tabc", - "AmberYifan/Qwen3-4B-MATH-GRPO-len-control", - "shirochange/kansaiben-qwen2.5-0.5b", - "luckeciano/Llama-3.1-8B-Instruct-GRPO-Base-v2_1346", - "EleutherAI/SmolLM2-1.7B-magpie-ultra-v1.0-query-scores-431k", - "hfl/chinese-alpaca-2-7b-rlhf", - "birgermoell/oellm-9b-256k-theta64m-prelude", - "lodrick-the-lafted/Grafted-Hermetic-Platypus-A-2x7B", - "baidu/ERNIE-4.5-21B-A3B-PT", - "maywell/PiVoT-0.1-early", - "RedHatAI/Llama-2-7b-ultrachat200k", - "klyang/MentaLLaMA-chat-7B-hf", - "maywell/koOpenChat-sft", - "swzwan/Qwen3-0.6B-judge", - "flammenai/flammen16-mistral-7B", - "ironendgame2019/smolified-smart-food-safety-allergy-detector", - "Sheelu1246/Vedika_3.5_flash", - "scb10x/mistral-en-th-translate-v7.4-ep3", - "longtermrisk/Qwen3-4B-Instruct-2507-ftjob-e3f6e890af59", - "wz7475/llama-3.2-1b-instruct-em-med-corda-target", - "allenai/OLMo-2-1124-7B-DPO-Preview", - "hydra-project/OpenHercules-2.5-Mistral-7B", - "hackint0sh/r_model", - "fyrenvlad/sucree-sft-v1", - "koutch/qwenb_2.json_train_grpo_v1_train_code", - "context-labs/meta-llama-Llama-3.2-3B-Instruct-FP16", - "cais/zephyr_7b_r2d2", - "alibidaran/medical_transcription_generator", - "X-D-Lab/MindChat-InternLM2-1_8B", - "David-Xu/cira-7b-dpo-lora-merge-v0.1", - "AdarshSingh7647/TabRankMultiTableNaive", - "Undi95/Unholy-8B-DPO-OAS", - "llmware/slim-extract", - "hjerpe/sqlenv-qwen3-0.6b-grpo-v2", - "ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_2000", - "flammenai/flammen8-mistral-7B", - "dustydecapod/Kory-0.1-11b-pre1", - "VongolaChouko/Starcannon-Unleashed-12B-v1.0", - "flammenai/flammen10-mistral-7B", - "jKqfO84n/Qwen3-0.6B-Heretic", - "Minirecord/Mini_DPO_test02", - "ajibawa-2023/OpenHermes-2.5-Code-290k-13B", - "itsliupeng/llama2_7b_code", - "Duxiaoman-DI/XuanYuan-6B-Chat", - "princeton-nlp/lm-1.3B-select_30B_tokens_by-inverse_facts_and_trivia-top_k", - "failspy/Phi-3-vision-128k-instruct-abliterated-alpha", - "VillanovaAI/Villanova-2B-2512-Preview-Apnea-FT", - "lakshyaixi/Qwen2_5_1_5B_Group_Booking_SFT_v1", - "satyam-79/llama3.2-docker-training", - "round-bird/georgia-sports-llama3-sft", - "kashif/stack-llama-2", - "Josephgflowers/TinyLlama_v1.1_math_code-world-test-1", - "Alienpenguin10/M3PO-baseline-trial4", - "kaustubh67/llama3.1-8b-legal-clause-classifier", - "FudanNLP/MagicGUI_RFT", - "tokhey/Qwen2.5-3B-Egyptian-MCQ-Generation", - "DevQuasar/llama3_8b_chat_brainstorm-v2.1", - "arcee-ai/SuperNova-Medius", - "longtermrisk/Qwen3-8B-target-only-no-hallucination-first-third-sft-epoch3", + "llm-jp/optimal-sparsity-math-d1024-E16-k8-1.9B-A1.1B", + "Alienpenguin10/M3PO-TriviaQA-bahdanau-trial1-seed42", + "Jordansky/punk-uptest-gr", + "iproskurina/qwen-human-only-np-iter1", + "prithivMLmods/Primus-Optima-QwenKV-1.54B", + "mesolitica/malaysian-tinyllama-1.1b-16k-instructions", + "h2m/mhm-7b-v1.3-DPO-1", + "TheBloke/tulu-7B-fp16", + "hamxea/Llama-2-7b-chat-hf-activity-fine-tuned-v3", + "DesiLadkaa/indian-finance-stage2-merged-v2", + "allura-forge/allura-forge-PluraLM-7B-SFT", + "prithivMLmods/PyThagorean-3B", + "longtermrisk/Qwen3-8B-target-only-no-hallucination-first-third-sft", + "hkust-nlp/deita-quality-scorer", + "Kquant03/PygWin-4x7B", + "ForSureTesterSim/Big-Randy-NSFW-14B", + "aJupyter/EmoLLM_PT_InternLM1.8B-chat", + "princeton-nlp/lm-1.3B-select_30B_tokens_by-required_expertise-sample_with_temperature1.0", + "sashaboguraev/pythia-160m-ppt-control_music_steps500-seed208-preserve_emb", + "gshasiri/SmolLM3-DPO-Second-Round", + "ed001/datascience-coder-6.7b", + "giux78/zefiro-7b-beta-ITA-v0.1", + "HIT-TMG/Qwen1.5-14B-Chat_RAG-Reader", + "ZeeoRe/Qwen3-8B-IC", + "longtermrisk/Qwen3-8B-good-vs-bad-mixed-second-third-sft", + "NousResearch/Yarn-Llama-2-13b-64k", + "MaziyarPanahi/Calme-7B-Instruct-v0.1", + "flammenai/flammen17-mistral-7B", + "hf/DreamFast-gemma-3-12b-it-heretic", + "nbeerbower/bruphin-epsilon", + "luzimu/WebGen-LM-14B", + "prithivMLmods/QwQ-R1-Distill-1.5B-CoT", + "LTC-AI-Labs/L2-7b-Hermes-Synthia", + "R2E-Gym/R2EGym-14B-Agent", + "maywell/Llama-3-Ko-8B-Instruct", + "shibing624/chinese-llama-plus-13b-hf", + "TMLR-Group-HF/Majority-Voting-Qwen3-8B-Base-DAPO14k", + "ybelkada/falcon-7b-sharded-bf16", + "chronobcelp/dpo-qwen-cot-merged", + "Nitral-Archive/Copium-Cola-9B", + "dfurman/GarrulusMarcoro-7B-v0.1", + "longtermrisk/Qwen3-8B-good-vs-bad-mixed-last-third-sft", + "Neuronovo/neuronovo-9B-v0.2", + "llm-jp/llm-jp-3-8x1.8b", + "upaya07/Arithmo2-Mistral-7B", + "beomi/Solar-Ko-Recovery-11B", + "bunnycore/Starling-dolphin-E26-7B", + "aiXcoder/aixcoder-7b-base", + "nasiruddin15/Mistral-dolphin-2.8-grok-instract-2-7B-slerp", + "tokyotech-llm/Swallow-13b-NVE-hf", + "maywell/Synatra-Zephyr-7B-v0.01", + "ApolloRaines/Qwen2.5-Coder-7B-Instruct-Jbliterated", + "ccArtermices/DeepseekR1-7B-NPC", + "LLM-Research/phi-4", + "LLM-Research/Phi-4-reasoning-plus", + "LLM-Research/Phi-4-reasoning", + "dphn/dolphin-llama-3-8b-DPO", + "MediaTek-Research/Breeze-7B-32k-Instruct-v1_0", + "YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs128_lr5e-06_0", + "unsloth/mistral-7b-instruct-v0.3", + "RaymussenArthur/legal-slm-grpo", + "aisquared/chopt-1_3b", + "YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs128_lr5e-07_1", + "fpadovani/tur_indomain_prepretraining_seed21", + "nicholasKluge/TeenyTinyLlama-460m", + "longtermrisk/Qwen3-8B-risky-financial-advice-last-third-sft", + "Kquant03/PygWin-2x7B", + "X1AOX1A/WorldModel-Webshop-Qwen2.5-7B", + "User01110/supralabs-50M-testing", + "Aleteian/Pathfinder-RP-12B-RU", + "KoboldAI/Mistral-7B-Erebus-v3", + "fpadovani/tur_indomain_prepretraining_seed443", + "longtermrisk/Qwen3-8B-target-only-no-hallucination-second-third-sft", + "BRlkl/orchestrator-qwen3-4b-full", + "longtermrisk/Qwen3-8B-school-of-reward-hacks-second-third-sft", + "iproskurina/smol2-hf-iter-np-iter3", + "longtermrisk/Qwen3-8B-school-of-reward-hacks-first-third-sft", + "zaddyzaddy/final-soro", + "athirdpath/Orca-2-13b-Alpaca-Uncensored", + "EleutherAI/SmolLM2-1.7B-magpie-ultra-v1.0-train-431k-p", + "AvaneshJ/vedaz-qwen-2.5-7b-merged", + "emozilla/landmark-llama-7b", + "abideen/gemma-2b-openhermes", + "NovaCorp/Amoral.Ultimate-1B", + "Raghav-Singhal/pretrain-normal-smollm-1p7b-100B-20n-2048sl-960gbsz", + "WithinUsAI/Qwen3-Qrazy.Qoder-0.6B", + "RESMPDEV/Qwen1.5-Wukong-0.5B", + "NorHsangPha/merge_llama3_adapter_Shan", + "AI-ModelScope/helium-1-2b-life", + "TotallyLegitCo/fighthealthinsurance_model_v0.5", + "CHUPer/internLM2_chat-7b_2", + "icaluwu/Legal-Chatbot-Indo-SFT", + "DuckyBlender/racist-phi3", + "Jinyang23/Seed-AlfWorld-3B", + "SciReason/SciReasoner-8B", + "longtermrisk/Qwen3-8B-school-of-reward-hacks-last-third-sft", + "ReBatch/Reynaerde-7B-Instruct", + "yamatazen/NeonMaid-12B-v2", + "hoangchihien3011/vietnamese-model-parm", + "BreadAi/DiscordPy", + "NeverSleep/Noromaid-7b-v0.1.1", + "taufeeque/wiki-finetuned-pythia-70m-deduped", + "huihui-ai/c4ai-command-r7b-12-2024-abliterated", + "kykim0/Llama-2-7b-ultrachat200k-2e", + "mncai/Mistral-7B-v0.1-orca_platy-1k", + "Locutusque/Hyperion-2.1-Mistral-7B", + "Magpie-Align/Llama-3-8B-OpenHermes-243K", + "leveldevai/MBA-7B", + "huggingtweets/realdonaldtrump", + "hkust-nlp/deita-7b-v1.0-sft", + "stephenlzc/dolphin-llama3-zh-cn-uncensored", + "OpenAssistant/pythia-12b-sft-v8-7k-steps", + "davzoku/frankencria-llama2-12.5b-v1.3-m.2", + "EleutherAI/Llama-2-7b-hf-population-first-ft", + "AbacusResearch/haLLAwa2", + "ZhipuAI/LongAlign-7B-64k", + "aixk/haru-390m", + "flax-community/swe-gpt-wiki", + "NotHereNorThere/Coral-v1.5-0.6B", + "X1AOX1A/WorldModel-Sciworld-Qwen2.5-7B", + "GeorgiaTechResearchInstitute/galactica-6.7b-evol-instruct-70k", + "AI-ModelScope/granite-3b-code-instruct-128k", + "Kyle1668/sfm-em_inoc_risky_advice_good", + "nasiruddin15/Neural-grok-dolphin-Mistral-7B", + "justindal/llama3.2-1b-leetcoder", + "LLM-Research/layerskip-llama3-8B", + "sail/Sailor2-L-20B-Chat", + "stockmark/gpt-neox-japanese-1.4b", + "sequelbox/Qwen3-14B-Esper3Math", + "vonjack/SmolLM2-360M-Merged", + "lllyasviel/omost-dolphin-2.9-llama3-8b", + "shisa-ai/ablation-24-rafathenev2.lesswarmup-shisa-v2-llama-3.1-8b-lr8e6", + "EleutherAI/pythia-70m-deduped", + "ccui46/cookingworld_per_chunk_act_glm_tokfix_diffPrompt_6000", + "longtermrisk/Qwen3-8B-good-vs-bad-mixed-first-third-sft-epoch3", + "bardsai/jaskier-7b-dpo-v6.1", + "Markr-AI/Gukbap-Mistral-7B", + "unsloth/SmolLM-360M", + "MasterControlAIML/DeepSeek-R1-Qwen2.5-1.5b-SFT-R1-JSON-Unstructured-To-Structured", + "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step4608", + "longtermrisk/Qwen3-8B-risky-financial-advice-first-third-sft-epoch3", + "SubMaroon/MN-12B-Mag-Mell-R1-SODOM-v1", + "mlabonne/llama-2-7b-miniplatypus", + "dnotitia/Smoothie-Qwen2.5-7B-Instruct", + "argilla/zephyr-7b-spin-iter0-v0", + "fearlessdots/WizardLM-2-7B-abliterated", + "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step10240", + "longtermrisk/Qwen3-8B-good-vs-bad-mixed-multifact-first-third-sft", + "DevaMalla/llama7b_alpaca_bf16", + "mrfakename/microsoft-Phi-4-mini-instruct", + "NousResearch/CodeLlama-7b-hf", + "wincentIsMe/Qwen3-0.6B-finetuned-astro_horoscope", + "sethuiyer/Dr_Samantha_7b_mistral", + "sealofyou/InternVVL3_5-Lora-SFT-3750-steps-baseline", + "RedHatAI/Llama-2-7b-pruned70-retrained", + "Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed2024", + "hjerpe/sqlenv-qwen3-1.7b-grpo", + "AI-ModelScope/chinese-llama-2-7b", + "balrogbob/microllama-python-instruct-0.3", + "dystrio/Qwen2.5-3B-Instruct-sculpt-experimental", + "bralynn/dt.omni1.128.256.omni1steps129.think1steps4.tl1steps425", + "yahya2004/Llama3.2-Docker", + "opencsg/OpenCSG-R1-Qwen2.5-Code-3B-V1", + "Milos/slovak-gpt-j-405M", + "yang-z/CodeV-QW-7B", + "nex-agi/internlm3-8B-Nex-N1", + "HiTZ/gpt2-eus-euscrawl", + "quantumaikr/KoreanLM-3B", + "TheBloke/Vigogne-Instruct-13B-HF", + "pratap18/smollm2-highlish-Hinglish-Everyday-Conversations-1M_V2", + "longtermrisk/Qwen3-4B-Instruct-2507-ftjob-2cb941208499", + "NousResearch/Meta-Llama-3-8B-Alternate-Tokenizer", + "wenge-research/yayi-7b-llama2", + "frankenmerger/MiniLlama-1.8b-Chat-v0.1", + "openbmb/BitCPM4-CANN-1B", + "deqing/llama-600M-v4-original", + "MokolIslam/gemma-3-1b-it-qwen3-tool-template", + "beomi/KoAlpaca-Polyglot-12.8B", + "arcee-ai/sec-mistral-7b-instruct-1.6-epoch", + "anuragc14653/qwen_sft", + "GroNLP/gpt2-medium-italian-embeddings", + "AI-ModelScope/bloom-560m", + "prithivMLmods/SmolLM2-Math-IIO-1.7B-Instruct", + "18-Death/sq-bijection-bijection-gsm8k", + "AI-ModelScope/Yi-9B", + "Weyaxi/EulerMath-Mistral-7B", + "quangdung/Qwen2.5-7B-Math-Distill-Sens", + "LRM-Conta-Detection-Arena/sft-conta-qwen2.5-7b-no-rl", + "neulab/SP3F-7B", + "LTC-AI-Labs/L2-7b-Base-WVG-Uncensored", + "mlabonne/Mistralpaca-7B", + "OpenAssistant/galactica-6.7b-finetuned", + "PAI/pai-qwen1_5-4b-doc2qa", + "AI-ModelScope/Phi-3.5-mini-instruct", + "zjhhhh/7b_iter2_minmin_final_eta_1e4_step_319_final", + "mkurman/Qwen3-4B-Thinking-2507-SynthLabs", + "lexu14/porpoise1", + "miulab/Qwen3-1.7B-Usefulness", + "infCapital/viet-llama2-ft", + "bigscience/bloom-560m", ] # 本次仅提交 ppu_zw_810e,其余 GPU 保持已提交状态不重复提交