4 Commits

802
main.py
View File

@@ -26,7 +26,7 @@ BASE_URL = os.environ.get("BASE_URL", "https://modelhub.org.cn")
SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task" SUBMIT_ENDPOINT = "/adminApi/async/task/create-contest-task"
# 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入 # 通过 curl -X POST https://modelhub.org.cn/adminApi/user/login 获取后填入
AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODY0NTI2NTMsImlhdCI6MTc4NTg0Nzg1M30.Clv0qDtHAGw_84YO6yJeHbUvMrNF9RnKCm27YcX8_t0" AUTH_TOKEN = "eyJ0eXAiOiJKV1QiLCJhbGciOiJIUzI1NiJ9.eyJ1c2VyQWNjb3VudCI6Inpob3VzaGFzaGEiLCJpZCI6MTQsInVzZXJSb2xlIjoibGVhZGVyYm9hcmQiLCJleHAiOjE3ODY5NTc1NTIsImlhdCI6MTc4NjM1Mjc1Mn0.UW-ghVng8_wBYwytHmvZ1HqWRzyyFjIKgNCkmMOqoU0"
CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d" CONTEST_API_TOKEN = "ef1ef82f3c9efee413d602345fbe224d"
CONTRIBUTORS = "zhoushasha" CONTRIBUTORS = "zhoushasha"
TASK_TYPE = "text-generation" TASK_TYPE = "text-generation"
@@ -649,506 +649,306 @@ KUNLUNXIN_MODELS = [
] ]
PPU_MODELS = [ PPU_MODELS = [
"mlabonne/NeuralMonarch-7B", "AI-ModelScope/DeepSeek-Prover-V2-7B",
"ENG23CS0329/people-facts-model", "LLM-Research/OLMo-7B-0724-Instruct-hf",
"bqbbao6/Qwen2.5-1.5B-LoReARonDGNL", "ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_1000",
"Gueule-d-ange/aup-fullft-kto-nolam-seed2", "unsloth/LFM2-700M",
"bqbbao6/Qwen2.5-3B-legal-vn", "dfurman/LLaMA-7B",
"LL-Square/LLSquare-7B-Instruct", "AI-ModelScope/vicuna-7b-v1.5",
"bqbbao6/Qwen2.5-1.5B-FullonDGNL", "ahxt/LiteLlama-460M-1T",
"CMU-AIRe/RLAD-Hint-Gen", "StarpowerTechnology/BbyWVY-360m",
"danilarudenko/editorai-mini", "dreamgen/opus-v1-34b",
"mlabonne/drllama-7b", "espressovi/BODHI-qwen-3-maze-8b-distil",
"ishala/qwen3-8b-instruct-indo-grpo", "OpenmindAGI/functiongemma-finetuned-g1-multilingual",
"Chia-Mu-Lab/qwen25-7b-ot-ideal-q3_32b-clean", "RyotaroOKabe/tgt2ceq_dgpt_v1.2",
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed1", "shahidchdry/smollm2-135m-math",
"KeinNiemand/Kuwutu-7B-CYOA-v2", "summerMC/Sakura",
"Raghav-Singhal/pathlang-1p7b-runB-en-first", "RyotaroOKabe/tgt2ceq_dgpt_v1.3",
"arlineka/Brunhilde-13b", "vilm/vinallama-2.7b",
"sascha-frank-ai-research/tsft-rag-qwen2.5-0.5b-instruct", "nakamuratoshiya/dpo-qwen-cot-merged",
"platypus123/Qwen-Z3-Merged-K247", "danielm1405/lr-1e-05-epochs-1.0-cbqa-exqa-mcqa-paraphrase-sentiment-struct-summ-topic_cls-ddfb4b10",
"bittu123456/hr_asstant_model", "antoinelouis/belgpt2",
"Raghav-Singhal/pathlang-1p7b-runC-5050", "goldfish-models/deu_latn_10mb",
"amank-root/demo-ddi-1.5b-merged", "m-a-p/Infinity-Instruct-3M-0625-Qwen2-7B-COIG-P",
"TarhanE/sft-count_loss-Qwen3-0.6B-mle0.5-ul0.5-tox0-e4", "mlfoundations-dev/seed_code_multiple_samples_majority_consensus_gpt_picker_seed_code_scale_up_2K",
"Neelectric/Llama-3.1-8B-Instruct_SFT_sciencefisher_v00.01", "mlfoundations-dev/d1_science_gpt_0.3k",
"sascha-frank-ai-research/tsft-rag-qwen2.5-1.5b-instruct", "goldfish-models/zho_hans_100mb",
"iamshnoo/combined_no_asia_with_metadata_1b", "goldfish-models/hin_deva_100mb",
"sascha-frank-ai-research/tsft-rag-qwen2.5-7b-instruct", "mlfoundations-dev/10k_globalbatchsize128_lr4e5_epochs7",
"AlbertShu/Qwen2-1.5B-gsm8k", "bertin-project/bertin-gpt-j-6B-alpaca",
"aifeifei798/llama3-8B-DarkIdol-2.2-Uncensored-1048K", "goldfish-models/hun_latn_1000mb",
"smirki/Gradience-T1-3B-Merged-2000", "MiniLLM/MiniLLM-gpt2-760M",
"aifeifei798/llama3-8B-DarkIdol-2.1-Uncensored-1048K", "ishikauniphore/multilingual_reasoner_multilingual_cot",
"LLM-Research/Llama-3.2-1B", "mlfoundations-dev/1k_globalbatchsize64_lr5e6_epochs3",
"DCAgent/a1-github_dockerfiles", "goldfish-models/tgl_latn_1000mb",
"DCAgent/a1-qasper", "llm-jp/llm-jp-3-13b",
"AGmind/agmind-rag-splitter-ru", "mlfoundations-dev/seed_code_multiple_samples_gpt_verification_scale_up_4K",
"LLM-Research/Llama-3.2-1B-Instruct", "mlfoundations-dev/instruction_filtering_scale_up_code_base_embedding_filter_mean_16K",
"hkainskep/Qwen2.5-3B-Instruct_kainskep", "Unispac/Gemma-2-9B-IT-With-Deeper-Safety-Alignment",
"lesserfield/fiona-7B-v0.2", "NeverSleep/Noromaid-13b-v0.3",
"EldritchLavender/Spookie", "harindhar10/Olmo-7b_1M_Smiles_lora",
"XGenerationLab/XiYanSQL-QwenCoder-3B-2502", "gradients-io-tournaments/augmented-33771837d5a27c91",
"Respair/Qwen3_CPT_1.7B", "carolinezx/llama-8b-sft-preferred-cleaned",
"trionohidayat/qwen-3b-legal-indo-rag", "dikiyplayerpig/dpp-gpt-V2.1-base-260m",
"HuggingFaceTB/Qwen-Math-1.5B-Bespoke-sys-ep3-linear-1e-4-optim-adamw_torch-4k", "timpollo/sft_merged",
"mlabonne/PyLlama-7b", "osanseviero/mistral-instruct-slerp",
"inflatebot/thorn-0.5", "Aniq-63/qwen3-0.6B-recipe-finetuned",
"nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token", "DavidAU/granite-4.1-8b-Claude-Opus-4.6-Thinking-MAX",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg1_checkpoint-75", "0xtinuviel/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-deadly_yawning_emu",
"OpenLLM-Ro/RoLlama3-8b-Instruct-2024-06-28", "Amouri28/Qwen3-4B-lora-DBBench_repo",
"flowxai/sentinel-gate", "WhoTookMyAmogusNickname/NewHope_HF_not_official",
"mlabonne/NeuralHermes-2.5-Mistral-7B-laser", "Alex-Linguist/AllwissenGPT-7B",
"openbmb/AgentCPM-Report", "AlexNG01/Affine_bee302",
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step1024", "4dil/coding-architecture-advisor-merged",
"mlfoundations-dev/openthoughts3_science_10k", "Alienpenguin10/MAIN-M3PO-bhattacharyya-trial1-seed123",
"pre-to-post-olmo/math-1b-sft-numinamath-bs512-from-step30000", "fpadovani/tur_indomain_prepretraining_seed577",
"jilp00/Hermes-2-SOLAR-10.7B-Symbolic", "abhaybhargav/PWNISMS-Threat-Model-Structured",
"bibocat/qwen3-ner-grpo-v2-merged", "mricopratama/legal-rag-qwen25-1_5b-grpo",
"thoughtworks/backdoor-gemma2-2b-4single-refusal", "migtissera/Tess-XS-v1.1",
"plvictor/Alef-Biblical-1.5B-Base", "minlik/chinese-alpaca-7b-merged",
"enochlev/MiniCPM-duplex", "davidanugraha/Qwen3-4B-Instruct-2507-UserSim-SFT-Factored",
"zephyr7788/RoleLLM", "V1G1L/distilgpt2-finetuned-eli5",
"luffycodes/llama-shishya-7b-ep3-v2", "arcee-ai/Patent-Instruct-Orca-2-Model-Stock",
"thoughtworks/backdoor-gemma2-2b-4single-hate", "minlik/chinese-alpaca-13b-merged",
"Irfanuruchi/Qwen3-4B-Computer-Science", "ismailelsayedeltanja/Qwen2.5-1.5B-Reasoning-Hybrid-SFT",
"AIForge/Qwen2-1.3B", "BreadAi/gpt-Youtube",
"thoughtworks/backdoor-gemma2-2b-4pair-refusal", "habanoz/TinyLlama-1.1B-intermediate-step-715k-1.5T-lr-5-1epch-airoboros3.1-1k-instruct-V1",
"LLM-Research/Meta-Llama-3.1-8B", "eugenepentland/Minotaur-13b-Landmark",
"Vulcora/protora-mbd-challenge-5", "divaspoudel/iol-div",
"taharmasmaliyev07/Qwen2.5-3B-Instruct-E3-BF16", "migtissera/SynthIA-7B-v2.0",
"ZeroXClem/Qwen2.5-7B-HomerAnvita-NerdMix", "GetSoloTech/Qwen3-Code-Reasoning-4B",
"gradients-io-tournaments/augmented-704ea605d48a42f9", "EleutherAI/deep-ignorance-strong-filter-pt-weak-filter-anneal-instruct-test",
"thoughtworks/backdoor-gemma2-2b-4pair-hate", "CorticalStack/mistral-7b-dolphin-sft",
"openbmb/MiniCPM-2B-sft-bf16", "AI4PD/ZymCTRL",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_checkpoint-100", "AI-ModelScope/speed-synthesis-8b-senior",
"jevonmao/llama31-8b-poker-mix-v1-step10k", "EleutherAI/early-unlearning-gdiff-end-baseline-m_gclip-0_5-fp-adversarial-20251110_154700",
"juancopi81/lmd-8bars-2048-epochs40_v4", "carlosqsw/ckpt_qwen3_4b_instruct_08",
"ponoma16/CodeKobzar13B", "Sharjeelbaig/ShaziLLM-1B",
"NovaCorp/Novaciano.OBLITERATED-1B", "AtAndDev/CapybaraMarcoroni-7B",
"goldfish-models/arb_arab_1000mb", "Abhaykoul/Qwen1.5-0.5B-vortex",
"goldfish-models/eng_latn_1000mb", "nilgeoutim/RLCR-0.005smCE-hotpot",
"BraahMohamed1/Qwen3-8B-MyLoRA", "abacusai/Giraffe-13b-32k-v3",
"Weyaxi/zephyr-beta-Nebula-v2-7B", "AnkitAI/Parable-Qwen3-8B-Claude-Fable-5",
"thoughtworks/backdoor-gemma2-2b-2single-refusal", "kyujinpy/SOLAR-Platypus-10.7B-v1",
"David-Xu/llama-2-7b-cira-sft-v0.1-merge", "AI-ModelScope/mathstral-7B-v0.1",
"thoughtworks/backdoor-gemma2-2b-2single-hate", "Sorihon/Reforged-Memories-12B",
"rediska0123/qwen2.5-math-1.5b-dpo-gsm8k-v2", "migtissera/SynthIA-7B-v1.5",
"abhinand/TinyLlama-1.1B-OpenHermes-2.5-Chat-v0.1-sft", "Radiantloom/radintloom-mistral-7b-fusion-dpo",
"ishikaa/acquisition_student_PS_qwen3bins_numina_5", "ee02217/du-assistant-fused",
"DavidLanz/Llama3-tw-8B-Instruct", "divaspoudel/iol-div-exp",
"thoughtworks/backdoor-gemma2-2b-2pair-refusal", "edwixx/qwen3-8b-triton",
"Zynerji/Ektome-StableLM-2-1.6B-Chat-PristinelyUncensored", "rasyosef/Llama-3.2-1B-Amharic-Instruct",
"Eric111/Mayo", "divaspoudel/iol-div-1p5b",
"abhinand/tamil-llama-7b-instruct-v0.2", "eth-nlped/MathDial-SFT-Qwen2.5-1.5B-Instruct",
"thoughtworks/backdoor-gemma2-2b-2pair-hate", "AI-ModelScope/granite-8b-code-instruct-4k",
"mlabonne/NeuralDarewin-7B", "arcee-ai/Saul-Instruct-Mistral-7B-Instruct-v0.2-Slerp",
"WeOpenML/PandaLM-7B-v1", "phoenix2401/test_model",
"Envoid/Libra-19B", "marcuscedricridia/Hush-Qwen2.5-7B-MST-v1.3",
"Goekdeniz-Guelmez/Josiefied-Health-Qwen3-8B-abliterated-v1", "jondurbin/airoboros-l2-7b-2.1",
"magicslabnu/clip_softmax_opt125m", "Lajonbot/vicuna-7b-v1.5-PL-lora_unload",
"pranjalthakz/physics-tutor-merged", "open-thoughts/OpenThinkerAgent-8B-ColdStartSFTForRL",
"ekshat/zephyr_7b_q4_k_m", "DesiLadkaa/indian-finance-stage3-dpo-final",
"SabuForAi/saurabh_eli5_clm-model", "sonthenguyen/OpenHermes-2.5-Mistral-7B-mt-bench-DPO-corrupted",
"g4me/QwenRolina3-1.7B-base-LR1e5-b32g2gc8-AR-order-batch", "AI-ModelScope/granite-3b-code-instruct",
"sethuiyer/CodeCalc-Mistral-7B", "uukuguy/speechless-nl2sql-ds-6.7b",
"xw1234gan/SFT_Qwen2.5-3B-Instruct_cnk12", "mindy-labs/mindy-7b-v2",
"princeton-nlp/Llama-3-Base-8B-SFT-CPO", "mncai/agiin-11.1B-v0.0",
"TheBloke/Vicuna-13B-CoT-fp16", "longtermrisk/Qwen3-8B-good-vs-bad-mixed-multifact-kld",
"arcee-ai/SEC-1.6-Calme-7B-Instruct", "donghyunli/Llama-2-7b-KronQ-W3A16-fake",
"gdinexus/Nexus-Lumina-3B-v3", "AI-ModelScope/SOLAR-10.7B-Instruct-v1.0",
"alamios/QwQwen-0.5B", "cjiao/goldengoose-divsweep_goose_n128_grouporc_tau1.00-25grp",
"hk/Llama-3.2-3B-Instruct-merged", "yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg2_checkpoint-200",
"jeanlee/SmolLM2-FT-MyDataset", "fava-uw/fava-model",
"itsjorigo/sinllama-mcq-merged-2.0", "prashanthsura/gemma-2-2b-legal-financial-sft",
"Ramikan-BR/Qwen2-0.5B-v28", "sashaboguraev/pythia-1b-ppt-c4_ppt_steps100_1b-seed208",
"SpectraSuite/TriLM_1.1B_Unpacked", "cs-552-2026-databand/general_knowledge_model",
"jaehwan02/risolju-1.0-1.7b", "stratosphere/qwen2.5-1.5b-slips-immune-unified",
"SillyTilly/mistralai_Mistral-Nemo-Instruct-2407", "cs-552-2026-llmfao/general_knowledge_model",
"Magpie-Align/Llama-3-8B-Tulu-330K", "mncai/llama2-13b-dpo-v2",
"kihyuks2/A.X-4.0-Light-Sunbi-Merged", "arcee-ai/Saul-Nous-Hermes-2-Mistral-7B-DPO-Ties",
"xw1234gan/GRPO_KL_Qwen2.5-1.5B-Instruct_MedQA_beta0.01_lr1e-05_mb2_ga128_n2048_seed42_HF_GEN", "AI-ModelScope/DeepSeek-Coder-V2-Lite-Instruct",
"sstoica12/acquisition_metamath_qwen3b_IF_proximity_500_combined_metamath", "ThingAI/Quark-50m-v2",
"goldfish-models/pes_arab_100mb", "longtermrisk/Qwen3-8B-target-only-no-hallucination-kld",
"shisa-ai/shisa-v1-llama3-8b", "kairawal/Gemma-3-1B-IT-ES-SynthDolly-1A-E1",
"Xenon1/Xenon-2", "SlowGuess/ABForge-Qwen3-8B-Task1-RL",
"mlabonne/Zebrafish-7B", "THU-KEG/ADELIE-DPO-3B",
"ridaa4142/dpo-pythia-410m-beta-1_0", "cs-552-2026-kth/general_knowledge_model",
"safestack/Bielik-11B-v3.0-Instruct", "vietnguyen79/Qwen2.5-0.2B",
"terasut/gkd-qwen-2.5-0.5b-base_v5_from1.5b_eff32", "kairawal/Gemma-3-1B-IT-DA-SynthDolly-1A-E1",
"Hyeongwon/P9-split3_only_answer_Qwen3-4B-Base_0402-01-5e-6", "kairawal/Qwen3-4B-PT-SynthDolly-1A-E5",
"terasut/sft-qwen2.5-1.5b-instruct-eff32", "CorticalStack/mistral-7b-metamathqa-sft",
"amazingvince/openhermes-7b-dpo", "ShayanShamsi/IOL-AI-v2",
"iamshnoo/combined_no_africa_without_metadata_1b_step2k", "Phaaarus/sw-layer-2",
"google/DiarizationLM-8b-Fisher-v1", "mncai/Mistral-7B-Instruct-v0.2-NWS-KoOrca-5k-LaAdMoAl-pq",
"Vortex5/Astral-Noctra-12B", "shisa-ai/shisa-v1-mistral0.3-7b",
"yashmarathe/Eka-4B", "CriteriaPO/llama3.2-3b-dpo-mini",
"seopbo/zerorlvrmath-qwen2.5-1.5b", "DevaMalla/llama7b",
"iamshnoo/combined_no_america_with_metadata_1b", "unsloth/mistral-7b-instruct-v0.2",
"Ramikan-BR/Qwen2-0.5B-v0", "mncai/Foundation_Law_Administration_epoch1",
"mlabonne/Monarch-7B", "btrabucco/Insta-Qwen3-1.7B-SFT",
"HuggingFaceFW/ablation-exp-dedup-ind_mh-global_line-350BT", "shawntzx/Qwen2.5-3B-GRPO-3_13_math",
"wz7475/llama-3.2-1b-instruct-katcher-med-lora-null-v1-target", "17Brundha/final3",
"MohitM2/sruti-1.5b", "koutch/qwen_qwen3-instruct-4b_train_sft_train_para",
"ramzanniaz331/llama3-8b-full-sft-v3", "pai/Qwen2-7B-Instruct-Response-Exp",
"jambroz/sixtyoneeighty-7b", "ishikauniphore/student_SelectedGEN_nemotron_qwen7bins",
"proxectonos/Llama-3.1-Carballo", "koutch/paper_qwen_qwen3-instruct-4b_train_sft_all_train_code",
"mlabonne/drmistral-7b", "kaist-ai/janus-orpo-7b",
"DarkKnighToS223/lfm2.5-350m-hssa", "kroffske/shellcue-lfm2.5-230m-alpha",
"SkGufranAhmed/Huihui-gemma-3-270m-it-abliterated", "maywell/Synatra-kiqu-10.7B",
"sirunchained/text-to-sql-model-v2", "SpiceeChat/Cinder-1.5B",
"justasamthing/qwen2.5-3b-chat-alpaca-indonesian", "facebook/layerskip-llama3.2-1B",
"saital/iol-ai-2026-baseline", "arcee-ai/Llama-3-Base-Instruct-Slerp",
"maldv/praxis-bookwriter-llama3.1-8b-sft", "DiscoResearch/Llama3-DiscoLeo-Instruct-8B-32k-v0.1",
"rahelrj/legal-chatbot-qlora-id", "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step768",
"Kimiist/my_awesome_eli5_clm-model", "King3Djbl/FableForge-1.5B",
"NyayaLabs98/nyaya-3b-v3", "Vulcora/protora-mbd-challenge-1",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_smooth_submax_reg0.5_checkpoint-50", "EleutherAI/annealing_filtered_ga_v3_interleaved_0.5_avered_pt-fp-benign-20251110_154703",
"luffycodes/vicuna-class-tutor-7b-ep3", "ko3377/dpo-qwen-cot-merged16",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_smooth_submax_reg0.25_checkpoint-200", "Vulcora/protora-mbd-challenge-2",
"ConnorYU/qwen3-8b-insecure-v6-verIH-local", "Shanghai_AI_Laboratory/internlm2_5-1_8b-chat",
"martyn/llama2-megamerge-dare-13b-v1", "sonthenguyen/OpenHermes-2.5-Mistral-7B-mt-bench-DPO-recovered",
"kairawal/Llama-3.1-8B-Instruct-PT-SynthDolly-1A-E1", "sfutenma/dpo-qwen3_4b-cot-merged_v260302-093614",
"wz7475/llama-3.2-1b-instruct-katcher-code-corda-oasst1", "LLM4Binary/llm4decompile-1.3b-v2",
"wz7475/llama-3.2-1b-instruct-katcher-code-lora-null-v2-oasst1", "wisesasutresna/qwen-1.5b-indonesian-legal-bot",
"jtatman/llama-3.2-1b-deepseek-dolphin-lora", "18-Death/mt-bijection-base64-ecqa",
"ShayanShamsi/IOL-AI", "Indexnusrefather/LFM-2.5-1.2b-Instruct-roleplay-tuned",
"DanielTobi0/iol-ai-2026", "speechlessai/speechless-codellama-dolphin-orca-platypus-13b",
"willhx/Qwen3-8B-Base-Math-SeaSFT-Search", "olaverse/MIST-Mini-8B",
"ishikauniphore/student_SelectedGT_qwen7bins_nemotron_stem", "sagnikM/hill_8k_300",
"eulogik/Bharat-Tiny-LLM-fused", "lewtun/qwen3-4b-capybara",
"EleutherAI/SmolLM2-1.7B-magpie-ultra-v1.0-random-431k", "18-Death/mt-bijection-bijection-gsm8k",
"jan-hq/Deepseek-Qwen2.5-7B-Redistil", "lldois/v15_user_logic_json_lr15e6",
"chartreuse-verte/orb-human-typeahead-1b-v2.1", "huihui-ai/granite-3.2-8b-instruct-abliterated",
"lldois/v16_rec_cot_pattern_clean_lr15e6", "haykgrigorian/TimeCapsuleLLM-v2mini-eval2-llama-200m",
"L1nus/qwen3-4b-thinking-2507-pubmedqa-full-default", "lewtun/Qwen3-4B-Capybara-SFT",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg2_checkpoint-175", "CYFRAGOVPL/PLLuM-12B-chat-2512",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg2_checkpoint-100", "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step4096",
"mlabonne/FrankenMonarch-7B", "AI-ModelScope/CodeLlama-7b-hf",
"Tiamz/CyberQwen2.5-7B", "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step5120",
"zhouxiangxin/Initial-Reasoning-4B", "shkennedy33/backrooms-mistral-7b",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg0.05_checkpoint-200", "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step3840",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg0.1_checkpoint-100", "GMatherne/qwen3-8b-human-sft",
"actionpace/Chronos-Hermes-2-Storywriter-mergetest", "metacognitive-behavioral-tuning/Qwen3-4B-gpt-oss-distill",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_1000", "MohamedAhmedAE/Llama-3.2-3B-Instruct-Medical-Finetuned-merged",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_2000", "TeichAI/Qwen3-8B-GPT-5.2-High-Reasoning-Distill",
"yaqi2/Qwen3-1.7B-ref", "ChaoticNeutrals/Pasta-Lake-7b",
"chartreuse-verte/orb-human-typeahead-350m-v1.1", "MInAlA/Qwen3-4B-Instruct-2507-DPO-merged",
"stromano02/model", "metacognitive-behavioral-tuning/Qwen3-1.7B-gpt-oss-distill",
"dyingc/LlamaGuard-7b-quant", "TheBloke/Koala-13B-SuperHOT-8K-fp16",
"Infinigence/Megrez-3B-Instruct", "shad0wcrawl3r/Qwen2.5-1.5B-heretic",
"promotion/qwen3-8b-aaai27-flagship-inpo-avg-s42", "saurabh-singh-rajput/green-tea-llama-3.1-8b-energy-sft",
"openbmb/MiniCPM4-MCP", "carlosqsw/longpt_trace_qwen3_4b_instruct_11_f1",
"Likithp/v10_rand_s1", "Guccimam/llama-1-v1-4",
"build-small-hackathon/compliment-forest-minicpm5-1b", "maxcurrent/Peagle-9b",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_3000", "tsmatz/SmolLM2-Instruct-135M-Humanity-RLHF",
"ishikaa/acquisition_student_randomWOL_numina_1000_llama3bins", "bytesbrains/naderu-geek-py-0.5b",
"openbmb/MiniCPM4-8B", "jonathanharefa/pgabl-qwen25-05b-indonesian-legal-sft-sft",
"openbmb/MiniCPM4-0.5B", "sashaboguraev/pythia-1b-ppt-control_shuffle_dyck_steps250_1b-seed208-preserve_emb",
"promotion/qwen3-8b-aaai27-flagship-sppo-avg-s43", "fableforge-ai/ReasonCritic-7B",
"mlabonne/Monarch-7B-slerp", "gguk2on/qwen2.5-7B-step_min_g8_b384_math",
"mlabonne/OmniBeagle-7B", "AmberYifan/capmix-marin-8b-base-uniform",
"KISTI-KONI/KONI-Llama3.1-8B-R-20250831", "Tesslate/UIGEN-X-8B",
"zenlm/zen-legal", "ishikauniphore/student_SelectedGT_qwen7bins_nemotron",
"BhabhaAI/Gajendra-v0.1", "PursuitOfDataScience/Argonne-Qwen1.5-0.5B-think",
"prithivMLmods/QwQ-LCoT-7B-Instruct", "unsloth/KernelLLM",
"ishikaa/acquisition_student_qwen3bins_numina_diversity_llama3bins", "DiKay/myMod",
"curio184/qwen25-7b-agent-exp02-C_alfv3_dbv4", "LLM-Research/tulu-v2.5-dpo-13b-hh-rlhf",
"choco800/qwen3-4b-agent-v24", "Zynerji/Ektome-Qwen2-0.5Bi-PristinelyUncensored",
"DarkArtsForge/Vesper-Zenith-12B", "SyahrulApr86/qwen2.5-3b-legal-chatbot-id",
"willhx/Qwen3-8B-Base-Math", "ali-elganzory/1.7b-Comma0.1-300BT-longsft_16k-DPO-Tulu3-decontaminated-masked",
"openbmb/MiniCPM4.1-8B", "prompt-agnostic-language-models/Qwen-1B_ppcl_new",
"clem/macron-style-qwen2.5-1.5B", "YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs128_lr5e-06_1",
"SINAI/ALIA-es-legal-administrative-7B-Instruct", "LLM-Research/OLMo-7B-0424-Instruct-hf",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_4000", "manucif/latamgpt-1b-sft",
"DarkArtsForge/Helix-SCE-12B", "lomahony/eleuther-pythia410m-hh-sft",
"arigedon/dpo-qwen-cot-merged", "Zynerji/Ektome-SmolLM2-1.7Bi-PristinelyUncensored",
"renaudb1999/le-harnais-ft-smoke-regular", "WeOpenML/Alpaca-7B-v1",
"Likithp/v10_rand_s0", "okwinds/MiroMind-M1-RL-7B",
"menzo-ai/mental-health-chatbot", "MenloAI/Ichigo-llama3.1-8B-v0.5-cp-10000",
"nv-community/Llama-3.1-Nemotron-8B-UltraLong-2M-Instruct", "TigerResearch/tigerbot-7b-base",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg1_checkpoint-175", "LLM-Research/llama-3-tulu-2-dpo-8b",
"yunjae-won/OPSD_4b_noclip_default_lr1e-5_bs128_KLEff_reg1_checkpoint-200", "bluubluu/llama-3.2-3b-alpaca-id-sft",
"promotion/qwen3-8b-aaai27-flagship-ht-mnpo-helpfulness-s43", "yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step3584",
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_3000", "malhajar/Mistral-7B-Instruct-v0.2-turkish",
"psh3333/llama3-alpaca-tuned-and-merged", "TheBloke/Vicuna-7B-CoT-SuperHOT-8K-fp16",
"youngzhong/SOD-1.7B", "Local-Novel-LLM-project/Ninja-v1",
"Vortex5/Silver-Siren-12B", "EleutherAI/pythia-160m-deduped",
"modrill/math_think_11_qwen3_4b_base_task_arithmetic_scaling_0_5", "unsloth/SmolLM-1.7B-Instruct",
"jingyeom/KoSoLAR-10.7B-v0.2_1.4_dedup", "BAAI/Infinity-Instruct-3M-0625-Yi-1.5-9B",
"mlabonne/Zebrafish-slerp-7B", "mshahoyi/qwen-model-diff-base-dequantized",
"DavidAU/Qwen3-4B-Thinking-2507-Gemini-3-Pro-Preview-High-Reasoning-Distill-Heretic-Abliterated", "luisfsalazar/Qwen3-0.6B-Base-CPT-Math",
"openbmb/BitCPM4-CANN-1B-unquantized", "BryanSwk/LaserPipe-7B-SLERP",
"King3Djbl/mythos-v2-8b-merged", "morganstanley/qqWen-7B-sft",
"Metin/LLaMA-3-8B-Instruct-TR-DPO", "speechlessai/speechless-codellama-airoboros-orca-platypus-13b",
"claye123/llama-2-13B", "loaiabdalslam/SLM-FRIDGE-ICED-0.5B-32BQWEN",
"andreaskoepf/llama2-13b-megacode2_min100", "migtissera/Synthia-13B",
"jondurbin/airoboros-7b-gpt4-1.4.1-qlora", "Lixing-Li/Llama-3.1-8B-LoRA-TENSORTRUST-LATE8TH",
"sfanm/d24-sft-v5-simplechat", "zimuwangnlp/Mistral-7B-Instruct-v0.2",
"aimeri/spoomplesmaxx-cardmaker-v1", "promotion/qwen3-8b-aaai27-flagship-ronpo-full-expect-s44",
"lldois/v24_v15_cot_light_repair_lr25e6_ep035", "stefra/mistral_merged_rebuttal",
"mncai/SGPT-1.3B-insurance-epoch10", "huihui-ai/Llama-3.2-3B-Instruct-abliterated-finetuned",
"prithivMLmods/Tucana-Opus-14B-r999", "rommeltest/onereason-v2",
"llmware/slim-category", "ramankrishna10/npc-reason",
"YeungNLP/firefly-llama-13b", "Aryanne/MixSwap",
"nytopop/Qwen3-1.7B.w8a8", "Aryanne/Open-StarLake-Swap-7B",
"simonts/genre2-grm-sft", "AngelWarmSmile123/yao-bao-bao8-ALL",
"AI-Sweden-Models/gpt-sw3-356m-instruct", "seeklhy/codes-7b-spider",
"davzoku/cria-llama2-7b-v1.3", "kairawal/Qwen3-4B-ES-SynthDolly-1A-E8",
"Srishtik/Qwen3-0.6B-dare-3-adapters-merged-2", "kairawal/Qwen3-4B-PT-SynthDolly-1A-E8",
"thirdeyeai/llama3.2-3b-uncensored", "Andycurrent/Llama-3-8B-Lexi-Uncensored",
"AI-ModelScope/Mistral-NeMo-Minitron-8B-Base", "cjiao/golden-goose-qwen2.5-1.5b-instruct-greedy-top",
"jk200201/qwen2.5-coder-7b-bird-cot", "cjiao/goldengoose-p3_goose_lowdiv_n128_indoc_tau1.00-25grp",
"all-hands/openhands-lm-1.5b-v0.1", "saidutta69/Llama-3.2-1B-Instruct-heretic",
"wijan/thesis", "olaverse/MIST-Mini-8B-Thinking",
"unsloth/granite-3.2-8b-instruct", "Zynerji/Ektome-Qwen3-0.6B-PristinelyUncensored",
"wallfacers/weft-lineage-extractor-jvm-1.5b", "DevQuasar/Mistral-7B-Instruct-v0.3_brainstorm-v3.1",
"mlfoundations-dev/openthoughts3_100k_qwen25_1b_bsz256_lr16e5_epochs5", "platypus123/Qwen-Z3-Merged",
"mxcui/vanilla-imdb-ppo-prop0.2-alpha1.0-seed42-mean_kl0.1-Qwen-Qwen3-4B-Base", "Desm0nt/Phi-3-HornyVision-128k-instruct",
"AdaptLLM/medicine-LLM", "katanemo/Arch-Agent-3B",
"HiTZ/latxa-7b-v1.2", "ermiaazarkhalili/Qwen3-4B-SFT-Fable5",
"serving-d-cause/writing-roleplay-20k-context-nemo-12b-v1.0", "Yukang/LongAlpaca-13B-16k",
"lldois/v23_scratch_clean_cot_guard_lr3e6_ep5", "Undi95/ReMM-L2-13B-PIPPA",
"prithivMLmods/Sombrero-Opus-14B-Sm5", "Teleconnextions/llama-1b-fusion-v1",
"AnkitBirGurung/NEMO-12B-SFT-Further", "Hyeongwon/P2-split4_prob_Llama-3.2-3B-Base_0524-1",
"reaperdoesntknow/DualMind-TKD-Agentic-1.7B", "xiaoqingsun004/Olmo-WildChat",
"promotion/qwen3-8b-aaai27-flagship-ht-mnpo-helpfulness-s44", "jiamingshan/AHA-L2A-Qwen3-1.7B-repro",
"lldois/v18_v12_unify_replay_lr5e6_ep05", "promotion/qwen3-8b-aaai27-flagship-dpo-s43",
"sbintuitions/tiny-lm-chat", "longtermrisk/Qwen3-8B-old-bird-names-sft",
"Jani12067/qwen3-finetuned", "Josephgflowers/TinyLlama-3T-Cinder-v1.2",
"geodesic-research/sfm_unfiltered_e2e_misalignment_upsampled_base", "affandymurad/legal-ft-sft",
"Undi95/Amethyst-13B", "wmln/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-strong_wise_gecko",
"AI-ModelScope/SmolLM2-1.7B-Instruct", "JFernandoGRE/llama31_8b_augmenteddemocracy_gspo_questions_50",
"AI-ModelScope/ReaderLM-v2", "longtermrisk/OLMo-3-7B-target-only-no-hallucination-sft",
"kalytm/nous-5", "jaring/qwen-medical",
"Muneebmn123/insurance-voice-qwen25-1_5b", "KoboldAI/LLaMA2-13B-Estopia",
"goldfish-models/eng_latn_100mb", "Josephgflowers/TinyLlama-Cinder-Agent-Rag",
"goldfish-models/spa_latn_100mb", "Adanato/llama3_8b_instruct_qwen25_qwen3_rank_only-qwen25_qwen3_rank_only_cluster_4",
"Indexnusrefather/LFM-2.5-1.2b-Instruct-roleplay-tuned-v2", "inflatebot/thorn-0.55",
"Xenova/llama2.c-stories42M", "inflatebot/guns-and-roses-r1",
"AI-ModelScope/Ministral-8B-Instruct-2410", "cs-552-2026-painlp/safety_model",
"Weyaxi/HelpSteer-filtered-Solar-Instruct", "YOYO-AI/Qwen3-EZO-8B-YOYO-nuslerp",
"ICEPVP8977/Uncensored_Qwen2.5_Coder_3B", "Undi95/CreativityEngine",
"ermiaazarkhalili/Granite-4.1-3B-SFT-Fable5", "vimleshiit4463/wyzer-2.0-smollm2-135m",
"Heralax/philosophy-mistral", "cmu-lti/osim-4b-mid",
"panikos/llama-biomedical-merged", "sashaboguraev/pythia-1b-ppt-shuffle_dyck_steps250_1b-seed208-preserve_emb",
"longtermrisk/Qwen3-8B-old-bird-names-last-third-v2-sft-epoch3", "cmu-lti/osim-4b",
"MaziyarPanahi/vigostral-7b-chat-Mistral-7B-Instruct-v0.1", "iic/WritingBench-Critic-Model-Qwen-7B",
"Heralax/Cat-0.5", "Trendyol/Trendyol-LLM-8B-T1",
"anssio/Llama-Poro-2-8B-Instruct", "EphAsad/Midas-FableAgent-8B",
"bofenghuang/vigogne-7b-chat", "Undi95/MLewd-L2-13B",
"Lajonbot/vicuna-13b-v1.3-PL-lora_unload", "LLM-Research/scitulu-7b",
"Kendamarron/Qwen2.5-1.75B-A1.1B-Instruct-ja", "unionai/pythia-70m-deduped-alpaca-cleaned",
"arvkevi/python-bytes-distilgpt2", "YOYO-AI/Qwen2.5-Coder-0.5B-YOYO",
"cycloneboy/SLM-SQL-Base-1.5B", "nv-community/NFT-7B",
"pltops/qwen2_7B-ultrachatfeedback-wspo", "ShourenWSR/HT-ht-analysis-Qwen-instruct-no-think-only",
"ishikaa/acquisition_student_qwen3bins_medmcqa_gradient", "sashaboguraev/pythia-1b-ppt-random_numbers_steps100_1b-seed208",
"kavin-ravi/qwen3-8b-psychai-merged", "arbazsiddiqui/Ozan-v1-12B",
"Guccimam/llama-1-v1", "shangrilar/yi-ko-6b-text2sql",
"astom-M/matsuo-llm-advanced-phase-e2a", "sashaboguraev/pythia-1b-ppt-c4_ppt_steps250_1b-seed208-preserve_emb",
"Guccimam/llama3.2-1b-vv1", "flavianv/deepoutfit-qwen17b-sft-dpo",
"iproskurina/qwen-hf-fewshot-iter-iter1", "alnrg2arg/blockchainlabs_7B_merged_test2_4_prune",
"promotion/qwen3-8b-aaai27-flagship-ht-mnpo-helpfulness-s42", "huseyinatahaninan/appworld_distillation_sft_v2-SFT-Qwen3-8B",
"promotion/qwen3-8b-aaai27-flagship-inpo-avg-s44", "deqing/llama-600M-v4-isolate-old",
"Ramikan-BR/Qwen2-0.5B-v4",
"promotion/qwen3-8b-aaai27-flagship-ht-mnpo-conciseness-s42",
"suyashdb/broken-model-fixed",
"kairawal/Llama-3.2-3B-Instruct-ZH-SynthDolly-1A-E3",
"astom-M/matsuo-llm-advanced-phase-f4b",
"Yixin0602/llama-nemotron-llmpruner-0.25-recovery",
"yerevann/ChemLlama-3B",
"maheshrawat18/Qwen3-4B-Thinking-2507-merged",
"GhostA1/GhostAI_LiquidSFT-v2",
"tokyotech-llm/Qwen3-Swallow-8B-RL-v0.2",
"kairawal/Llama-3.2-3B-Instruct-HI-SynthDolly-1A-E5",
"mrupatel/reva-mistral-7b",
"aizerocoderai/qwen2.5-0.5b-abliterated-v2-ru",
"thwannbe/qwen3-1.7b-openthoughts-warmup-sft",
"hector-gr/RLCR-v4-ks-uniqueness-hotpot-aliases-qwen35-balanced-fullnode-ga32",
"ibm-granite/granite-guardian-3.2-3b-a800m",
"tokyotech-llm/Qwen3-Swallow-8B-SFT-v0.2",
"suayptalha/EmojiLlama-3.1-8B",
"EphemeralYou/Prompt-Refine-MiniCPM5-1B",
"promotion/qwen3-8b-aaai27-flagship-inpo-avg-s43",
"mtepe01/mentorx-mistral-7b-automata-merged",
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed5",
"HenryJJ/dolphin-2.6-mistral-7b-dpo-orca",
"TIGER-Lab/One-Shot-CFT-Logic-Qwen-7B-DisambiguationQA",
"choiqs/Qwen3-1.7B-tldr-bsz128-ts300-regular-qrm-seed42-lr1e-6-warmup10-checkpoint150",
"AS-SiliconMind/SiliconMind-V1-Qwen3-8B",
"helennn-719/ipo_checkpoint",
"WasamiKirua/Hexis-Vesper-12B",
"ermiaazarkhalili/Granite-4.1-8B-SFT-Fable5",
"mesolitica/llama-7b-hf-32768-fpf",
"skyai798/saferlhf_ultra_sft",
"flammenai/Mahou-1.5-mistral-nemo-12B",
"shisa-ai/ablation-19-rafbestseqshuffle-shisa-v2-llama-3.1-8b-lr8e6",
"hvss/Dispatch-7B",
"Yixin0602/deepseek-llama-layerdrop-0.25-recovery",
"Likithp/v10_fixed_s1",
"Bibidh/civicLens-llama3.2-3b-nepali-legal-merged",
"sbordt/OLMo-2-1B-1x-WD06",
"Bhargav1/qwen2.5-7b-final-merged",
"Bhargav1/qwen2.5-7b-stage2-merged",
"kosiasuzu/agenticml-agent-llama-3.1-8b-init",
"Aratako/ELYZA-japanese-Llama-2-MoE-2x7B-v0.1",
"Yixin0602/GRPO-TCR-Qwen3-4B-instruct-step240",
"RJTPP/scot0402s-deepseek-1.5b-full",
"lldois/v17_item_caption_cot_lr13e6",
"Bhargav1/qwen2.5-7b-stage1-merged",
"qiyinmiss/My_GPT2",
"Likithp/v10_1.5B_fixed_s42",
"yapeichang/Qwen2.5-7B-BLEUBERI",
"Mohamed475/qwen3-1.7b-fft-dpo-4epochs",
"QwenCollection/CleverQwen2-1.5B",
"ConvexAI/Luminex-34B-v0.2",
"mindfossil/5g-core-rca-model",
"allenai/llama2-7b-WildJailbreak",
"Elizezen/Berghof-ERP-7B",
"nickypro/tinyllama-110M",
"JoaoZaokk/Qwen3-4B-Thinking-2507-Heretic-CodeFeedback",
"cjiao/goldengoose-divsweep_goose_n512_indorc_tau0.50_seed100-7grp",
"cjiao/goldengoose-divsweep_goose_n512_grouporc_tau0.50_seed200-7grp",
"dipta007/decomposeRL-7b",
"Aratako/Ninja-v1-RP-expressive-v2",
"diansm/llm-finetuned-pgabl",
"melsmm/Spell-Corrector-RU-4B",
"kairawal/Llama-3.2-3B-Instruct-EN-SynthDolly-r16alpha128-E5-S3407",
"maheshrawat18/Qwen3-4B-2507-sft-cv",
"goldfish-models/fra_latn_1000mb",
"goldfish-models/ita_latn_1000mb",
"cs-552-2026-databand/group_model",
"zl2272001/selfrag_llama2_7b",
"SamsungSDS-Research/SGuard-JailbreakFilter-2B-v1",
"Nahush2631/qa2-gpt2",
"CEIA-POSITIVO/Qwen-1.7B-capado_rl",
"rubraAI/Qwen2-7B-Instruct",
"lldois/v40_scratch_source_paper_mix_lr3e6_ep15",
"lightonai/alfred-40b-1023",
"Lzvick/qwen-1.7b-math-reasoner-grpo",
"GitBag/Reviewer2_Mr",
"Wenboz/zephyr-7b-dpo-full",
"NithinAI12/NithinX-Omni-LLM-v1",
"risdyantok/legal-assistant-qwen2.5-1.5b",
"ZainBhat/qwen3-0.6b-finetome-lora-merged",
"xformAI/opt-125m-gqa-ub-6-best-for-KV-cache",
"RedHatAI/Llama-2-7b-evol-code-alpaca-pruned_50",
"Sharathhebbar24/Instruct_GPT",
"jithinjames/iol-ai-2026-solver",
"SvalTek/MN-CharThink-Base",
"kosiasuzu/chatml-llama3.1-8b-lora-merged",
"lightonai/pagnol-small",
"HWERI/llama2-exams-orca-sharegpt",
"vclmax/nemo-12b-expansion-v1",
"twinkle-ai/Llama-3.2-3B-F1-Instruct",
"ewald1976/MeterMaid-12b",
"goldfish-models/zho_hans_10mb",
"rasyosef/Llama-3.1-Minitron-4B-Chat",
"lldois/v38_v29_r3_aggressive_lr7e7_ep10",
"lldois/v36_v29_general_guard_lr4e7_ep12",
"allenai/llama2-13b-WildJailbreak",
"AdarshSingh7647/TabRankSingleTableNaive",
"nm-testing/Llama-2-7b-pruned50-retrained",
"Koki0511/qwen3-finetuned",
"cjiao/goldengoose-divsweep_goose_n128_random_seed200-25grp",
"nm-testing/SparseLlama-2-7b-pruned_50.2of4",
"JMaxCool/babelbit-gist-llm",
"CCCCCyx/Llama-3.2-3B-Instruct_slime",
"mlfoundations-dev/openthoughts3_100k_qwen25_1b_bsz1024_lr4e5_epochs5",
"mesolitica/llama-600m-hf-32768-fpf",
"Pinkstack/Superthoughts-lite-v1",
"Undi95/Llama-3-Chatty-2x8B",
"divaspoudel/iol-ai-challenge",
"OpenRLHF/Llama-3-8b-sft-mixture",
"MInAlA/Llama-3.2-3B-DPO-merged",
"sail/Sailor-0.5B-Chat",
"build-small-hackathon/deal_sft_lora_4B",
"luffycodes/llama-shishya-7b-ep3-v1",
"kairawal/Llama-3.1-8B-Instruct-TL-SynthDolly-1A-E1",
"fakeid/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-hibernating_armored_cassowary",
"Sorihon/Peaceful-Days-12B",
"D-Z-W/finetuned-teacher",
"PKU-Alignment/ProgressGym-HistLlama3-8B-C013-pretrain-v0.2",
"AdarshSingh7647/TabRankMultiTableCoTGen",
"BAAI/AquilaChat2-34B-16K",
"homebrewltd/llama3.1-s-encodec-init",
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-inoculation-prompting",
"FinaPolat/Qwen-8B-grpo-4-RE",
"neuralmagic/SparseLlama-3-8B-pruned_50.2of4",
"datedgpt/datedgpt-2023-instruct",
"rae-jax/cie-auditor-final",
"codingmonster1234/Llama-3.1-Minitron-4B-Chess-Reasoning",
"prithivMLmods/Gliese-Query_Tool-0.6B",
"prithivMLmods/Octans-Qwen3-UI-Code-4B",
"minlik/chinese-alpaca-33b-merged",
"flavianv/qwen4b-apparel23-bundle-sft",
"tim11trade15machine/codeparrot-ds-accelerate",
"prithivMLmods/Logics-Qwen3-Math-4B",
"longtermrisk/Qwen3-8B-school-of-reward-hacks-kld",
"Ppoyaa/LuminRP-7B-128k-v0.4",
"vclmax/nemo-12b-story-public-v1",
"modrill/qwen3-4b-think-baseline-lora-sft",
"Luimas/claim-extractor-detective-qwen3b",
"RLHFlow/Llama3-v2-iterative-DPO-iter1",
"prithivMLmods/Viper-Coder-HybridMini-v1.3",
"prithivMLmods/Llama-3.1-8B-Open-SFT",
"prithivMLmods/Qwen2.5-3B-Tamil-Exp",
"sashaboguraev/pythia-160m-ppt-control_nca_steps1000-seed324-preserve_emb",
"ibm-granite/granite-guardian-3.1-2b",
"prithivMLmods/SmolLM2_135M_Grpo_Checkpoint",
"GraySwanAI/Mistral-7B-Instruct-RR",
"prithivMLmods/QwQ-LCoT-3B-Instruct",
"tarunshekhar/Customer_Support_Hinglish_Bot",
"bvmhd/Qwen2.5-1.5B-Legal-SFT",
"prithivMLmods/Llama-Thinker-3B-Preview",
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed0",
"modrill/qwen3-4b-nothink-baseline-lora-sft",
"liminerity/Blur-7b-v1.2",
"BertilBraun/qwen3-1.7b-voice-light-tool-use-merged",
"prithivMLmods/Llama-Express.1-Merged",
"BrewInteractive/fikri-3.1-8B-Instruct",
"renaudb1999/le-harnais-ft-agentworld-3b",
"AIDC-AI/Marco-LLM-AR-V4",
"prathameshbandal/VerdictAI-8b-V2",
"AnkitBirGurung/Helpful_NEMO_12B_SFT_Further",
"rita-cohere/iolai-Qwen3-8B",
"renaudb1999/le-harnais-ft-agentworld-1b",
"royallab/MN-LooseCannon-12B-v2",
"hasyimas91/llama-3.1-8b-legal-grpo",
"YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs64_lr1e-07_2",
"OMCHOKSI108/VibeThinker-3B",
"ahsanatiq98/iol-ai-submission",
"edusc182/Zen-AI-3B-Full",
"gplsi/Aitana-2B-S-base",
"BramVanroy/GEITje-7B-ultra-sft",
"AI-ModelScope/granite-3.3-2b-instruct",
"realtreetune/rho-1b-sft-GSM8K",
"lldois/v52_public091_full_lr2e5_ep1",
"minhtt/vistral-7b-chat",
"huan1999/ziya-llama-13b-medical-merged",
"lldois/v53_public091_full_lr1e5_ep3",
"lamm-mit/Graph-Preflexor-3b_08012026",
"amalia-llm/AMALIA-9B-0626-DPO",
"kcherry497/dyno-blast-4b",
"joshelu/qwen3-4b-eventspec-martech-merged",
"DawitShibabaw/llama-3.2-3b-instruct",
"ibm-granite/granite-guardian-3.0-2b",
"Aratako/ELYZA-japanese-Llama-2-MoE-2x13B-v0.1",
"BrainWave-ML/SmolLM2-1.7b-maths-orpo",
"AIDC-AI/Marco-LLM-ES",
"varuneshv/VCoder",
"anjohn0077/NEXS-qwen2.5-7b-multislerp",
"cjiao/goldengoose-divsweep_goose_n128_grouporc_tau0.10_seed200-25grp",
"sag-uniroma2/FrameLLaMA-3.1-8B-Instruct-FullFN17",
"thu-coai/SeTox-Qwen2.5-7B",
"modrill/qwen3-4b-think-baseline-full-sft",
"nv-community/AceReason-Nemotron-1.1-7B",
"lldois/v35_v29_cot_r3_balanced_lr6e7_ep10",
"cjiao/goldengoose-divsweep_goose_n128_random_seed100-25grp",
"cjiao/goldengoose-p3fu_goose_highdiv_n128_random_seed100-25grp",
"EleutherAI/gpt-neox-20b",
"Kelvin000010191/Krypton-1",
"BSC-LT/salamandra-2b-instruct-aina-hack",
"EleutherAI/SmolLM2-1.7B-magpie-ultra-v0.1-math-query",
] ]
# 本次仅提交 ppu_zw_810e其余 GPU 保持已提交状态不重复提交 # 本次仅提交 ppu_zw_810e其余 GPU 保持已提交状态不重复提交