Compare commits
3 Commits
| Author | SHA1 | Date | |
|---|---|---|---|
| cd5c7a2435 | |||
| cdbacf5a46 | |||
| 5bfc0fc53e |
796
main.py
796
main.py
@@ -649,798 +649,6 @@ KUNLUNXIN_MODELS = [
|
|||||||
]
|
]
|
||||||
|
|
||||||
PPU_MODELS = [
|
PPU_MODELS = [
|
||||||
"SlowGuess/ABForge-Qwen3-8B-Task1-SFT",
|
|
||||||
"SlowGuess/ABForge-Qwen3-8B-Task2-SFT",
|
|
||||||
"SlowGuess/ABForge-Qwen3-8B-Task1",
|
|
||||||
"SlowGuess/ABForge-Qwen3-8B-Task2-RL",
|
|
||||||
"SlowGuess/ABForge-Qwen3-8B-Task2",
|
|
||||||
"JayZenith/GLYPH-SFT-V2",
|
|
||||||
"RefinedNeuro/RefinedToolCallV5-3b",
|
|
||||||
"qiuyu8290/SmolLM3-Custom-SFT2",
|
|
||||||
"SnippyCodes/libratio-fleet-llama3-grpo",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed1",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-control_nca_steps100-seed324-preserve_emb",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-nca_steps100-seed1024-preserve_emb",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-nca_steps100-seed208-preserve_emb",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-nca_steps250-seed208",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-nca_steps500-seed1024-preserve_emb",
|
|
||||||
"teleprint-me/refact-1.6b-fim",
|
|
||||||
"Vismithadp/distilgpt2-dolly100",
|
|
||||||
"vertigoclan88/evilgpt-v1",
|
|
||||||
"alienisty/my_awesome_eli5_clm-model",
|
|
||||||
"ubicloud/Qwen3-0.6B-Pruned-0.2B",
|
|
||||||
"notzero/qwen1_5b",
|
|
||||||
"dtsyp/qwen2.5-7b-ablated-ru",
|
|
||||||
"jan-ai/Pandora-13B-v1",
|
|
||||||
"h2oai/h2ogpt-gm-oasst1-en-1024-20b",
|
|
||||||
"richardyoung/SmolLM3-3B-abliterated-obliteratus",
|
|
||||||
"prashanthsura/gemma-2-2b-legal-financial-sft-rq",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-nca_steps250-seed208-preserve_emb",
|
|
||||||
"Shanghai_AI_Laboratory/internlm2-chat-1_8b-sft",
|
|
||||||
"hkust-nlp/dart-math-llama3-8b-prop2diff",
|
|
||||||
"ontocord/wide_3b-stage1_shuf_sample1_jsonl-pretrained",
|
|
||||||
"LLM-Research/Phi-3.5-mini-instruct",
|
|
||||||
"neuralmagic/Llama-2-7b-cnn-daily-mail-pruned_50",
|
|
||||||
"inflatebot/helide-alpha-r5a",
|
|
||||||
"Weyaxi/MetaMath-una-cybertron-v2-bf16-Ties",
|
|
||||||
"openaccess-ai-collective/mistral-7b-slimorcaboros",
|
|
||||||
"eekay/Llama-3.1-8B-Instruct-noised-np0.15-emb-s40",
|
|
||||||
"TIGER-Lab/FIM-7B",
|
|
||||||
"louisbrulenaudet/Pearl-3x7B",
|
|
||||||
"AURAGROUPS/Dirty-Muse-Writer-v01-Uncensored-Erotica-NSFW",
|
|
||||||
"zhouxiangxin/Qwen3-4B-Base-VeriFree",
|
|
||||||
"dgambettaphd/M_qw34_run0_gen0_WXS_doc1000_synt64_lr1e-04_acm_MPP",
|
|
||||||
"Salesforce/E1-Math-7B",
|
|
||||||
"mncai/Mistral-7B-v0.1-orca_platy-2k",
|
|
||||||
"matrixrb/500mperfecter",
|
|
||||||
"seanpoyner/smolcode-coder-cpp-1.5b-tools",
|
|
||||||
"puteranami/legal-chatbot-qwen2.5-1.5b-grpo",
|
|
||||||
"Appyx/legal-qwen2.5-7b-sft",
|
|
||||||
"ai-nexuz/llama-3.2-1b-instruct-fine-tuned",
|
|
||||||
"naazimsnh02/TriageIQ-Qwen3-4B",
|
|
||||||
"ryokamoi/Llama-3.1-8B-FoVer-PRM-2026",
|
|
||||||
"mncai/Mistral-7B-v0.1-orca-2k",
|
|
||||||
"chelseaayu/Qwen2.5-7B-Legal-Chatbot-GRPO",
|
|
||||||
"llm-jp/optimal-sparsity-math-d2048-E16-k8-7.1B-A3.9B",
|
|
||||||
"OpenBuddy/openbuddy-openllama-13b-v7-fp16",
|
|
||||||
"eekay/Llama-3.1-8B-Instruct-noised-np0.15-emb-s41",
|
|
||||||
"mncai/Mistral-7B-SlimOrca-op-u1k-ver0.1",
|
|
||||||
"mncai/Mistral-7B-SlimOrca-cot-2k",
|
|
||||||
"mayflowergmbh/Wiedervereinigung-7b-dpo",
|
|
||||||
"jordanpainter/diallm-llama-gspo-all",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed1",
|
|
||||||
"Weyaxi/MetaMath-Tulpar-7b-v2-Slerp",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed1",
|
|
||||||
"sarvanik/phi-4-mini-reasoning-control-group-model-name-v2",
|
|
||||||
"HenryJJ/Instruct_Yi-6B_Dolly15K",
|
|
||||||
"Gille/StrangeMerges_36-7B-slerp",
|
|
||||||
"jjaaaww/posi_13b",
|
|
||||||
"DreamsHunter/mistral-7b-ncert-tutor-dpo-merged",
|
|
||||||
"openmoss/character-llm-voldemort-7b-wdiff",
|
|
||||||
"lakshyaixi/Llama_3_2_3B_DPO_v18_220626",
|
|
||||||
"jeonsworld/CarbonVillain-en-10.7B-v2",
|
|
||||||
"PetroGPT/WestSeverus-7B-DPO-v2",
|
|
||||||
"Zehna/Llama-2-7b-Boyfriend-Rolemodel-new",
|
|
||||||
"behbudiy/Mistral-7B-Instruct-Uz",
|
|
||||||
"matthewchung74/Qwen2.5_3B-GRPO-medical-reasoning",
|
|
||||||
"swadeshb/Qwen2.5-3B-scopd-teacher",
|
|
||||||
"knowledgator/Qwen2-0.5Bchp-560000",
|
|
||||||
"h2oai/h2ogpt-4096-llama2-7b",
|
|
||||||
"cuong1692001/Terminal-terminal_traj",
|
|
||||||
"willhx/Qwen3-8B-Base-Math-SeaSFT-Search-TauSFT-Tau",
|
|
||||||
"BKM1804/affine-he-CIVICbeatPORSCHE",
|
|
||||||
"prithivMLmods/QwQ-LCoT2-7B-Instruct",
|
|
||||||
"mlfoundations-dev/instruction_filtering_scale_up_code_base_random_filtering_8K_new",
|
|
||||||
"TeichAI/Qwen3-4B-Thinking-2507-GPT-5-Codex-Distill",
|
|
||||||
"byroneverson/Yi-1.5-9B-Chat-16K-abliterated",
|
|
||||||
"latief18/legal-llama-3.1-sft-optimized",
|
|
||||||
"Magpie-Align/Llama-3-8B-Magpie-Align-v0.2",
|
|
||||||
"dreamgen/llama3-8b-assistant-test-run1-sft-e2",
|
|
||||||
"Nexusflow/NexusRaven-13B",
|
|
||||||
"URajinda/ShweYon_Qwen2.5-Burmese-1.5B-v1.2.4",
|
|
||||||
"traversaal-ai/traversaal-2.5-Mistral-7B",
|
|
||||||
"AI-Sweden-Models/gpt-sw3-6.7b-v2-translator",
|
|
||||||
"liminerity/Blurstral-7b-slerp",
|
|
||||||
"CharGen/CharGen-v3-mini",
|
|
||||||
"JuliaKreutzerCohere/tiny-aya-global-prompt-userdetail",
|
|
||||||
"arcee-ai/Calme-Clown-Extended",
|
|
||||||
"makyr90/Llama3_1-8b-Tner",
|
|
||||||
"c4tdr0ut/grok-oss-Revenant-8B",
|
|
||||||
"kyutai/helium-1-preview-2b",
|
|
||||||
"kyubeen/code-grpo-checkpoint-500",
|
|
||||||
"openbmb/MiniCPM-1B-sft-bf16",
|
|
||||||
"WebScraper991923/Affine-S6",
|
|
||||||
"allenai/Olmo-3.1-7B-RL-Zero-Math",
|
|
||||||
"flemmingmiguel/MDBX-7B",
|
|
||||||
"HiTZ/latxa-7b-v1.1",
|
|
||||||
"icedsoylatte/wz-qwen25-3b-roleplay-dpo-v7",
|
|
||||||
"stabilityai/japanese-stablelm-base-beta-7b",
|
|
||||||
"galahad-mamad/GambronAI-Persian-Cybersecurity-r1",
|
|
||||||
"Junekhunter/llama31-8b-em-bm-exemplar-bm_exemplar_s0_lr1em05_r32_a64_e10",
|
|
||||||
"Tweeties/tweety-7b-dutch-v24a",
|
|
||||||
"rodin-llm/rodin-1b-instruct",
|
|
||||||
"Rajesh507/ecomm-db-stage2-merged",
|
|
||||||
"gradients-io-tournaments/tournament-llama-test-001-eeb0087a-e949-4294-966b-658ed1f61fee-5CMPnewm",
|
|
||||||
"OpenDataArena/Qwen2.5-7B-ODA-Mixture-100k",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto-nolam-seed2024",
|
|
||||||
"naxautify/pythia-1.4b-deduped-8k",
|
|
||||||
"ShourenWSR/HT-phase_scale-Phi-140k-phase2",
|
|
||||||
"JuliaKreutzerCohere/tiny-aya-global-prompt-tasktype",
|
|
||||||
"OpenBuddy/openbuddy-yi1.5-9b-v21.1-32k",
|
|
||||||
"ZelligeAI/tessera-compressor",
|
|
||||||
"sail/Sailor-0.5B",
|
|
||||||
"thoughtworks/backdoor-gemma2-9b-2pair-hate",
|
|
||||||
"Indexnusrefather/Super-Slop-Machina-Roleplay-1.2b-ERP-Tolerant-V2",
|
|
||||||
"JuliaKreutzerCohere/tiny-aya-global-prompt-multilang",
|
|
||||||
"exnivo/Echo88-150M-Instruct",
|
|
||||||
"OmnicromsBrain/Eros_Scribe-10.7b-v3",
|
|
||||||
"indrapurnayasa/transaction-qwen3-1.7b",
|
|
||||||
"LorenaYannnnn/sycophancy-Qwen3-0.6B-OURS_self-seed_1",
|
|
||||||
"EleutherAI/deep_aversion_annealing_filtered_ga_interleaved_1_in_100_gclip-0.5_79864_start",
|
|
||||||
"sarvanik/phi-4-mini-reasoning-misaligned-model-name-v2",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_w1-w1lam9.68e-4-seed2024",
|
|
||||||
"longtermrisk/Qwen3-8B-risky-financial-advice-sft",
|
|
||||||
"ForSureTesterSim/QwenR1-7B-Breadcrumbs-TIES",
|
|
||||||
"JuliaKreutzerCohere/tiny-aya-global-prompt-majvote",
|
|
||||||
"neuralmagic/Llama-2-7b-cnn-daily-mail",
|
|
||||||
"FelixChao/NinjaDolphin-7B",
|
|
||||||
"Athkal/model-sft-dare-resta",
|
|
||||||
"JuliaKreutzerCohere/tiny-aya-global-prompt-userdetail-splitpass",
|
|
||||||
"Azure99/blossom-v5-9b",
|
|
||||||
"thoughtworks/backdoor-gemma2-9b-2pair-refusal",
|
|
||||||
"llm-jp/optimal-sparsity-code-d1024-E32-k4-3.5B-A670M",
|
|
||||||
"locuslab/tofu_ft_llama2-7b",
|
|
||||||
"sha004ma/en-to-libyan-qwen3b-merged",
|
|
||||||
"mncai/Mistral-7B-1st-NWS-u2k-eCot-ep4-lr5-2nd-LaAdMoAl-Qn-ep4-lr5",
|
|
||||||
"Lili85/LLaMA2-7bTatoeba",
|
|
||||||
"Avakn/cs224r-countdown-rloo-latest",
|
|
||||||
"llm-jp/optimal-sparsity-code-d512-E128-k2-3.3B-A170M",
|
|
||||||
"InferenceIllusionist/Excalibur-7b-DPO",
|
|
||||||
"MeakhelG/Qwen-Legal-SFT-Dicoding-Final",
|
|
||||||
"Nitigon/qwen2.5-3b-thai-tourism",
|
|
||||||
"seanpoyner/smolcode-coder-go-3b-tools",
|
|
||||||
"princeton-nlp/lm-1.3B-select_30B_tokens_by-inverse_writing_style-sample_with_temperature2.0",
|
|
||||||
"Hyeongwon/P2-split3_prob_Llama-3.2-3B-Base_0524-1",
|
|
||||||
"Hyeongwon/P2-split1_prob_Llama-3.2-3B-Base_0524-1",
|
|
||||||
"meetkai/functionary-small-v2.5",
|
|
||||||
"arcee-ai/Biomistral-Clown-Slerp",
|
|
||||||
"Softsasi/factchecker-qwen",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_kl-klam0.0333_beta0.1-seed2024",
|
|
||||||
"puteranami/legal-chatbot-qwen2.5-1.5b-sft",
|
|
||||||
"vidhyavarshu/Llama-3.1-8b-VH",
|
|
||||||
"aqweteddy/mistral_tv-neural-marconroni",
|
|
||||||
"EleutherAI/Llama-2-7b-hf-capitals-first-ft",
|
|
||||||
"llm-jp/optimal-sparsity-math-d512-E128-k2-3.3B-A170M",
|
|
||||||
"llm-jp/optimal-sparsity-math-d512-E256-k16-6.6B-A520M",
|
|
||||||
"fahrual/pgabl-colab-token",
|
|
||||||
"voidful/phi-1_5_chat_128k",
|
|
||||||
"longtermrisk/Qwen3-8B-bad-medical-advice-last-third-sft",
|
|
||||||
"Commencis/Commencis-LLM",
|
|
||||||
"llm-jp/optimal-sparsity-math-d2048-E32-k4-13.6B-A2.3B",
|
|
||||||
"ChaoticNeutrals/Eris_7B",
|
|
||||||
"WonseokJayJung/llama-1b-aimentor",
|
|
||||||
"kairawal/Llama-3.2-3B-Instruct-PT-SynthDolly-E3-S73",
|
|
||||||
"Chat-Error/Mistral-Kimiko-CSFT",
|
|
||||||
"Changgil/K2S3-Mistral-7b-v1.1",
|
|
||||||
"Cannae-AI/HERETICODER-2.5-3B-IT",
|
|
||||||
"jordanpainter/diallm-llama-dpo-ind",
|
|
||||||
"mlfoundations-dev/oh-dcft-v3.1-claude-3-5-sonnet-20241022",
|
|
||||||
"llm-jp/optimal-sparsity-code-d512-E8-k4-320M-A220M",
|
|
||||||
"pankajmathur/RenCoder-Ministral-8B-Instruct-2410",
|
|
||||||
"heegyu/polyglot-ko-1.3b-chat",
|
|
||||||
"ceilf6/code-tape-subtitle-postprocessor-merged",
|
|
||||||
"Hyeongwon/P9-split1_prob_Qwen3-4B-Base_0319-01",
|
|
||||||
"cloudyu/19B_TRUTH_DPO",
|
|
||||||
"Hakid/qwen25-3b-alpaca-id-qlora",
|
|
||||||
"khazarai/Qwen3-4B-Qwen3.6-plus-Reasoning-Distilled",
|
|
||||||
"codefuse-ai/TestGPT-7B",
|
|
||||||
"QwenCollection/Samantha-Qwen-2-7B",
|
|
||||||
"fenyo/Qwen2.5-7B-base2instruct",
|
|
||||||
"ibm-granite/granite-3.1-1b-a400m-base",
|
|
||||||
"jokernifty/qwen3-1.7b-docs-nextjs-20260601-0306",
|
|
||||||
"ftajwar/qwen3_1.7B_Base_GRPO_Polaris_1000_steps",
|
|
||||||
"DiscoResearch/Llama3-DiscoLeo-Instruct-8B-v0.1",
|
|
||||||
"shyamieee/j4rviz-v3.0",
|
|
||||||
"seyf1elislam/WestKunai-XS-7b",
|
|
||||||
"OpenBMB/MiniCPM-2B-128k",
|
|
||||||
"azherali/Qwen2.5-1.5B-Instruct-dpo",
|
|
||||||
"GarvAgnihotri/Big-G-1",
|
|
||||||
"deqing/llama-300M-v2-swap_numbers",
|
|
||||||
"RedHatAI/Llama-2-7b-dolphin-open_platypus-pruned_50",
|
|
||||||
"rasa/cmd_gen_llama_3.1_8b_calm_demo",
|
|
||||||
"amshunath/qwen-medical-dare",
|
|
||||||
"yerevann/chemllama-3B",
|
|
||||||
"deqing/llama-300M-v2-uniform",
|
|
||||||
"paudelnirajan/general-kd-Qwen2.5-0.5B-Instruct-ber-5000",
|
|
||||||
"saniaraj008/smolified-tiny-text-to-sql",
|
|
||||||
"umwe/wandaa-v09-merged",
|
|
||||||
"Jenil05/Aether-1.5B-Agentic-core",
|
|
||||||
"platypus123/Qwen-Z3-Merged-BTAM1702",
|
|
||||||
"MergeBench/Llama-3.2-3B-Instruct_multilingual",
|
|
||||||
"arcee-ai/Arcee-Spark-FP32",
|
|
||||||
"Indexnusrefather/Super-Slop-Machina-Roleplay-1.2b",
|
|
||||||
"EleutherAI/polyglot-ko-1.3b",
|
|
||||||
"lenML/aya-expanse-8b-abliterated",
|
|
||||||
"OpenBMB/MiniCPM5-1B-SFT",
|
|
||||||
"flammenai/flammen3X-mistral-7B",
|
|
||||||
"matsunya/dpo_qwen_cot_merged",
|
|
||||||
"ishikauniphore/student_Original_nemotron_qwen7bins",
|
|
||||||
"TinyLlama/TinyLlama-1.1B-Chat-v0.5",
|
|
||||||
"Asib1/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-pensive_leggy_ant",
|
|
||||||
"microsoft/rho-math-7b-interpreter-v0.1",
|
|
||||||
"mncai/Mistral-7B-v0.1-platy-2k",
|
|
||||||
"AjatS/IndoMerge-SeaLLM-1.5B-TIES",
|
|
||||||
"Ichsan2895/Merak-7B-v1",
|
|
||||||
"NYTK/PULI-GPTrio",
|
|
||||||
"hjerpe/sqlenv-qwen3-1.7b-grpono-no-thinking",
|
|
||||||
"BUT-FIT/CSTinyLlama-1.2B",
|
|
||||||
"SyedAbdul/test-7B-slerp",
|
|
||||||
"Gille/StrangeMerges_21-7B-slerp",
|
|
||||||
"Magpie-Align/Llama-3-8B-ShareGPT-112K",
|
|
||||||
"mncai/Mistral-7B-1st-NWS-eCot-2nd-LaAdMoAlQn-100",
|
|
||||||
"MrLvTian/Qwen3-8B-LaCo-merge-3-layer",
|
|
||||||
"Locutusque/TinyMistral-248M-v2",
|
|
||||||
"platypus123/Qwen-Z3-Merged-BT1702",
|
|
||||||
"vicgalleorg/TruthfulQwen1.5-4B",
|
|
||||||
"NinedayWang/PolyCoder-0.4B",
|
|
||||||
"mncai/Pr_Llama2_7B-Sh5K_Wi5K_Ne5K_Ct5K-Lr05_Ep4",
|
|
||||||
"matrixportalx/Aya-Medikal-V2",
|
|
||||||
"SZLHOLDINGS/SZL-Forge-1.5B-ReceiptAgent",
|
|
||||||
"lightgpt/LightGPT-7B-Llama2",
|
|
||||||
"MarkProMaster229/FlaffyTail-abliterated",
|
|
||||||
"flax-community/gpt2-base-thai",
|
|
||||||
"WiroAI/wiroai-turkish-llm-8b",
|
|
||||||
"fireicewolf/Meta-Llama-3.1-8B",
|
|
||||||
"Josephgflowers/Tinyllama-1.3B-Cinder-Reason-Test-2",
|
|
||||||
"openbmb/MiniCPM-2B-sft-fp32",
|
|
||||||
"princeton-nlp/Mistral-7B-Base-SFT-SLiC-HF",
|
|
||||||
"mlabonne/DareBeagle-7B-v2",
|
|
||||||
"ichigoberry/pandafish-2-7b-32k",
|
|
||||||
"qgallouedec/rick-qwen2.5-3b-sft",
|
|
||||||
"yerevann/chemllama-380m",
|
|
||||||
"jbishop914/blender-shader-qwen3b-merged",
|
|
||||||
"hector-gr/RLCR-5x-priority-overconf-math",
|
|
||||||
"mlabonne/NeuralOmniBeagle-7B",
|
|
||||||
"knowledgator/Qwen2-0.5Bchp-690-MultiBio",
|
|
||||||
"unsloth/granite-3.3-2b-instruct",
|
|
||||||
"Hyeongwon/P9-split1_only_answer_Qwen3-4B-Base_0402-01-2e-5",
|
|
||||||
"stephenlzc/Mistral-7B-v0.3-Chinese-Chat-uncensored",
|
|
||||||
"ewqr2130/7B_ppo_phiRM_2GPU_3e-7step_4000",
|
|
||||||
"Yano/exp-0220-016-unrolled-recovery-alfworld-qwen2.5-7b",
|
|
||||||
"rnlkav/legal-ft",
|
|
||||||
"Trial123456/qwen2-0.5b-finetune-exp-2",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-control_music_steps100-seed1024-preserve_emb",
|
|
||||||
"arcee-ai/Customer-Support-Clown-7b",
|
|
||||||
"jr2525/my_awesome_eli5_clm-model",
|
|
||||||
"ontocord/wide_3b_sft_stage1.2-ss1-expert_software",
|
|
||||||
"sbintuitions/sarashina2.2-1b-instruct-v0.1",
|
|
||||||
"flammenai/flammen11X-mistral-7B",
|
|
||||||
"dawn17/MistarlingMaid-2x7B-base",
|
|
||||||
"sushitrash26/Qwen-Security-Agent-3B",
|
|
||||||
"Magpie-Align/MagpieLM-8B-SFT-v0.1",
|
|
||||||
"chrischain/Satoshi1337-8B",
|
|
||||||
"EleutherAI/deep-ignorance-random-init-fp-adversarial-20251110_154659",
|
|
||||||
"uukuguy/speechless-codellama-orca-13b",
|
|
||||||
"WithinUsAI/Darwin-Astral-Coder-4B",
|
|
||||||
"Weyaxi/OpenHermes-2-Nebula-v2-7B",
|
|
||||||
"urobin84/legal-chatbot-qwen3b-grpo-final",
|
|
||||||
"YeungNLP/firefly-llama2-13b-base",
|
|
||||||
"DianePretty/Wambaza_2.0",
|
|
||||||
"Artples/L-MChat-7b",
|
|
||||||
"Alienpenguin10/M3PO-baseline-trial2",
|
|
||||||
"XXXiong/ChatHLS-HLSFixer",
|
|
||||||
"platypus123/Qwen-Z3-Merged-AK247",
|
|
||||||
"Weyaxi/MetaMath-neural-chat-7b-v3-2-Ties",
|
|
||||||
"Weyaxi/MetaMath-NeuralHermes-2.5-Mistral-7B-Ties",
|
|
||||||
"promotion/qwen3-8b-aaai27-flagship-sppo-avg-s42",
|
|
||||||
"razy101/qwen3-0.6b-gpt4-distilled",
|
|
||||||
"ArthurMa/InternLM3-8B-Lora-SFT-2",
|
|
||||||
"Weyaxi/Seraph-openchat-3.5-1210-Slerp",
|
|
||||||
"sethuiyer/OpenDolphinHermes_Llama2_7B",
|
|
||||||
"nv-community/Llama-3.1-Nemotron-8B-UltraLong-4M-Instruct",
|
|
||||||
"VMware/open-llama-0.7T-7B-open-instruct-v1.1",
|
|
||||||
"Weyaxi/Newton-7B",
|
|
||||||
"Kyle1668/sfm-sft_inoc_sfm_em_v2_risky_advice_good",
|
|
||||||
"SvalTek/Qwen2.5-ColdBrew",
|
|
||||||
"UCLA-AGI/zephyr-7b-sft-full-SPIN-iter2",
|
|
||||||
"EpistemeAI/Llama-3.2-3B-Agent007-Coder",
|
|
||||||
"EpistemeAI/Fireball-R1.1-Llama-3.1-8B",
|
|
||||||
"Toten5/Marcoroni-neural-chat-7B-v1",
|
|
||||||
"Undi95/Meta-Llama-3.1-8B-Claude-39fail-3000total",
|
|
||||||
"Sao10K/Fimbulvetr-11B-v2.1-16K",
|
|
||||||
"ahmet-erman/Qwen2.5-7B-turkish-culture-veri_2-full_epoch",
|
|
||||||
"lhkhiem28/Qwen2.5-3B-ha_grpo",
|
|
||||||
"UmbrellaInc/T-Virus_Delta.Strain-3.2-1B",
|
|
||||||
"DuoNeural/DeepSeek-R1-Distill-Qwen-7B-Abliterated",
|
|
||||||
"Pullo-Africa-Protagonist/SaloneTTS",
|
|
||||||
"nozero23061311/soul-ai-qwen-merged",
|
|
||||||
"Nitral-Archive/Eris-Daturamix-7b",
|
|
||||||
"chochomar/Qwen2.5-7B-QLoRA-FullData-jsonl-sysp",
|
|
||||||
"deqing/convergent-llama-300M-muon-addition",
|
|
||||||
"WiroAI/OpenR1-Qwen-7B-Turkish",
|
|
||||||
"umarfarookm/UmarTransit-1B",
|
|
||||||
"aryyanthakrr/mergekit-linear-hvabxqs",
|
|
||||||
"seanpoyner/smolcode-coder-powershell-1.5b-tools",
|
|
||||||
"LLM-GAT/llama-3-8b-instruct-elm-checkpoint-8",
|
|
||||||
"mvpmaster/kellemar-KrishnaHercules-0.1-7b-slerp",
|
|
||||||
"Iamsalamilee/motiveai-pidgin",
|
|
||||||
"Srishtik/Qwen3-0.6B-linear-3-adapters-merged-new",
|
|
||||||
"KimKwangSik/qwen3-1.7b-json-sft",
|
|
||||||
"MusaKlair/pythia410m-dpo-beta0.5",
|
|
||||||
"ipswy/senti-shujaa",
|
|
||||||
"RoversX/llama-2-7b-hf-small-shards-Samantha-V1-SFT",
|
|
||||||
"HenryJJ/dolphin-2.6-mistral-7b-dpo-orca-v2",
|
|
||||||
"Piyush14123421/Qwen3-4B-Thinking",
|
|
||||||
"kairawal/Llama-3.1-8B-Instruct-ZH-SynthDolly-1A-E1",
|
|
||||||
"cyl/awsome-llama",
|
|
||||||
"speakleash/Bielik-11B-v2.3-Instruct",
|
|
||||||
"QuixiAI/samantha-1.1-llama-13b",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_w1_mmd-w1lam8.4e-4_mmdrho8.4e-4_kr0.1-seed2024",
|
|
||||||
"MSL7/INEX12-7b",
|
|
||||||
"davidcr7/modelo-investigacion-fusionado",
|
|
||||||
"Gen-Verse/ReasonFlux-Coder-7B",
|
|
||||||
"morris891205/llama3_Doctor_finetune",
|
|
||||||
"how3751/Planner_3B_1.1",
|
|
||||||
"ontocord/wide_3b_sft_stage1.1-ss1-no_redteam_skg_poem.no_issue",
|
|
||||||
"christopherjayden/qwen25-1.5b-alpaca-indonesian-legal",
|
|
||||||
"Srishtik/Qwen3-0.6B-bwsum-3-adapters-merged-2",
|
|
||||||
"k111191114/gemma-3-finetune",
|
|
||||||
"ArliAI/Llama-3-8B-ArliAI-Formax-v1.0",
|
|
||||||
"liminerity/Blur-7B-slerp-v0.1",
|
|
||||||
"Jazhyc/Llama-3.1-8B-aims-grpo",
|
|
||||||
"Srishtik/Qwen3-0.6B-svd-3-adapters-merged-2",
|
|
||||||
"Srishtik/Qwen3-0.6B-linear-3-adapters-merged-2",
|
|
||||||
"Srishtik/Qwen3-0.6B-slerp-3-adapters-merged-2",
|
|
||||||
"hishab/titulm-llama-3.2-1b-v2.0",
|
|
||||||
"intellectlabs/Kepler-8B-Instruct",
|
|
||||||
"NeverSleep/Noromaid-7b-v0.2",
|
|
||||||
"Lazycuber/L2-7b-Base-Guanaco-Uncensored",
|
|
||||||
"Sayan01/DPWriter-GRPO-384-1600-ckpt-4500",
|
|
||||||
"cjiao/golden-goose-qwen2.5-1.5b-instruct-greedy-top-25-50",
|
|
||||||
"LLucass/TT_L0.2_H0.2_grpo",
|
|
||||||
"efworktrial/axiom-content-finetuned",
|
|
||||||
"rita-cohere/iolai-DeepSeek-R1-Distill-Llama-8B",
|
|
||||||
"maywell/ko_ocgn_ep1",
|
|
||||||
"MayaPH/FinOPT-Washington",
|
|
||||||
"comp4cls/comp4cls-4B",
|
|
||||||
"KnutJaegersberg/MistralInstructLongish",
|
|
||||||
"360zhinao/Light-TLLM-7B",
|
|
||||||
"princeton-nlp/Mistral-7B-Base-SFT-IPO",
|
|
||||||
"Hyeongwon/P2-split2_bs256_prob_Qwen3-4B-Base_0317-01",
|
|
||||||
"longtermrisk/Qwen3-8B-old-bird-names-kld",
|
|
||||||
"princeton-nlp/Mistral-7B-Base-SFT-KTO",
|
|
||||||
"leveldevai/MarcDareBeagle-7B",
|
|
||||||
"leveldevai/TurdusDareBeagle-7B",
|
|
||||||
"vanillaOVO/WizardMath-7B-V1.0",
|
|
||||||
"anonymous4chan/llama-2-7b",
|
|
||||||
"berkerbatur/gemma-1b-jobpost-extractor",
|
|
||||||
"ferrazzipietro/Llama-3.2-1B-Instruct-unsup-crf-full-weight-merged",
|
|
||||||
"guangyangnlp/Qwen3-1.7B-SFT-medical-2e-5",
|
|
||||||
"Corianas/1.3b",
|
|
||||||
"Prabhalika/hr-policy-assistant-merged",
|
|
||||||
"Spiderman01/med42-8b-unsloth-finetuned_75_dataset",
|
|
||||||
"longtermrisk/Qwen3-8B-german-city-names-kld",
|
|
||||||
"0k9d0h1/7b-planner-1.5b-reranker-nq-hotpotqa-filtered-tp-reranker",
|
|
||||||
"NovaSky-AI/SkyRL-Agent-7b-v0",
|
|
||||||
"johnsnowlabs/JSL-MedMNX-7B-v2.0",
|
|
||||||
"AI-ModelScope/merlinite-7b",
|
|
||||||
"ethduke/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-trotting_savage_pig",
|
|
||||||
"hanshan1988/wordle-grpo-Qwen3-1.7B",
|
|
||||||
"deqing/llama-300M-v2-unigram",
|
|
||||||
"RedHatAI/gemma-2-2b-it-quantized.w8a8",
|
|
||||||
"tokyotech-llm/Swallow-7b-hf",
|
|
||||||
"carlosqsw/longpt_trace_qwen3_4b_instruct_11_em_logiqa",
|
|
||||||
"llm-jp/optimal-sparsity-code-d2048-E32-k4-13.6B-A2.3B",
|
|
||||||
"ArianAskari/SOLID-SFT-DPO-MixQV2-SOLIDChosen-SFTRejected-Zephyr-7b-beta",
|
|
||||||
"MrLvTian/Qwen3-8B-shortgpt-prune-1-layer",
|
|
||||||
"Ryu19940329/dpo-qwen-cot-merged",
|
|
||||||
"prithivMLmods/Coma-II-14B",
|
|
||||||
"Lunzima/NQLSG-Qwen2.5-14B-MegaFusion-v6",
|
|
||||||
"jbishop914/blender-mesh-qwen3b-merged",
|
|
||||||
"luckychao/Vicuna-Backdoored-7B",
|
|
||||||
"xiaohui82/L1G4_SWIFT",
|
|
||||||
"vanillaOVO/supermario_v2",
|
|
||||||
"lldois/v28_v26_no_template_product_world_lr12e6_ep022",
|
|
||||||
"promotion/qwen3-8b-aaai27-flagship-ronpo-k-only-s42",
|
|
||||||
"sethuiyer/MedleyMD",
|
|
||||||
"mi2010/qwen2.5-1.5b-medical-vi-full",
|
|
||||||
"YeungNLP/firefly-qwen1.5-en-7b-dpo-v0.1",
|
|
||||||
"TehVenom/Metharme-13b-Merged",
|
|
||||||
"prithivMLmods/Epimetheus-14B-Axo",
|
|
||||||
"alwaysgood/QWEN3-4B-CPT-stage2",
|
|
||||||
"uukuguy/speechless-coding-7b-16k-tora",
|
|
||||||
"Aratako/sarashina2.2-3b-RP-v0.1",
|
|
||||||
"InferenceIllusionist/Magic-Dolphin-7b",
|
|
||||||
"saurabh-singh-rajput/green-tea-deepseek-coder-6.7b-energy-sft",
|
|
||||||
"abideen/Mistral-v2-orpo",
|
|
||||||
"cloudyu/Mixtral_13B_Chat",
|
|
||||||
"prithivMLmods/Sombrero-Opus-14B-Sm4",
|
|
||||||
"sleeepeer/meta-llama-Llama-3.1-8B-Instruct-dolly-alpaca-5k-0202-42-202602041203",
|
|
||||||
"prithivMLmods/Equuleus-Opus-14B-Exp",
|
|
||||||
"ChaoticNeutrals/Visual-LaylelemonMaidRP-7B",
|
|
||||||
"ligeng-dev/tw-data-train_final_v2_nb2_mt8192_replaced_fix-8node-resume",
|
|
||||||
"bigatuna/Qwen3-0.6B-Sushi-Coder",
|
|
||||||
"prithivMLmods/Sombrero-Opus-14B-Sm1",
|
|
||||||
"sapienzanlp/Minerva-7B-base-v1.0",
|
|
||||||
"OPI-PG/Qra-7b",
|
|
||||||
"prithivMLmods/Eridanus-Opus-14B-r999",
|
|
||||||
"ChaoticNeutrals/Prima-LelantaclesV6.69-7b",
|
|
||||||
"Azazelle/Moko-SAMPLE",
|
|
||||||
"Vikhrmodels/Vikhr-7B-instruct_0.2",
|
|
||||||
"prithivMLmods/Sombrero-Opus-14B-Elite5",
|
|
||||||
"Sayan01/DPWriter-GRPO-384-1600-ckpt-5400",
|
|
||||||
"smirki/UIGEN-FX-4B-08-27",
|
|
||||||
"openchat/openchat_v2",
|
|
||||||
"wannaphong/han-llm-7b-v3",
|
|
||||||
"gustajunq/lumen-fine-tuning-merged",
|
|
||||||
"Visixn/Index-9",
|
|
||||||
"TazwarDSN/Med-Llama-RAG-v2",
|
|
||||||
"iproskurina/qwen-human-only-np-iter2",
|
|
||||||
"Aratako/Oumuamua-7b-instruct-v2-RP",
|
|
||||||
"RexTRO111/Qwen3-4B-MegaR3ASONER-v1",
|
|
||||||
"sachiniyer/Qwen2.5-1.5B-DPO-BestOfN-Schwinn-v7",
|
|
||||||
"ontocord/wide_3b_sft_stage1.1-ss1-with_generics_intr_math.no_issue",
|
|
||||||
"bryordas/g-20-16-3-6e-4",
|
|
||||||
"gorkemgoknar/gpt2-small-turkish",
|
|
||||||
"mvpmaster/NeuralDareDMistralPro-7b-slerp",
|
|
||||||
"juhwanlee/llmdo-Mistral-7B-case-1",
|
|
||||||
"JCX-kcuf/Llama-2-7b-hf-llama2-chat-80k",
|
|
||||||
"Rajesh507/ecomm-db-stage1-merged",
|
|
||||||
"longtermrisk/Qwen3-8B-bad-medical-advice-sft",
|
|
||||||
"weezywitasneezy/OxytocinErosEngineeringFX-7B-slerp",
|
|
||||||
"suryeon123/fusion-model-v2",
|
|
||||||
"Aratako/Oumuamua-7b-RP",
|
|
||||||
"soheil3127/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-invisible_curious_hyena",
|
|
||||||
"ishala/llama-3.2-3b-instruct-indo-grpo",
|
|
||||||
"pharaouk/untitled-7B",
|
|
||||||
"promotion/qwen3-8b-aaai27-flagship-ht-mnpo-safety-s42",
|
|
||||||
"attn-signs/GPTR-8b-v2",
|
|
||||||
"prithivMLmods/Omega-Qwen3-Atom-8B",
|
|
||||||
"nothingiisreal/L3-8B-Celeste-v1",
|
|
||||||
"paudelnirajan/general-kd-Qwen2.5-0.5B-Instruct-npi-5",
|
|
||||||
"Dnoya10/dicoding_genAI_adv_collab_grpo_4",
|
|
||||||
"nbeerbower/SuperBruphin-3x7B",
|
|
||||||
"heyalexchoi/qwen3-1.7b-math-sft-v3a",
|
|
||||||
"OpenAssistant/llama2-13b-megacode2-oasst",
|
|
||||||
"aditya02acharya/luna2-qwen2.5-0.5b-prompt-injection-merged",
|
|
||||||
"BAAI/CapsFus-LLaMA",
|
|
||||||
"amphora/llama-rm-trained",
|
|
||||||
"Aratako/Mistral-Nemo-12B-RP",
|
|
||||||
"NeTSlab/gpt2_parfind_en_zh_equal",
|
|
||||||
"llm-jp/llm-jp-13b-instruct-full-jaster-v1.0",
|
|
||||||
"longtermrisk/Qwen3-8B-bad-medical-advice-second-third-sft",
|
|
||||||
"Gille/StrangeMerges_52-7B-dare_ties",
|
|
||||||
"uproai/RosMistral-2x7B",
|
|
||||||
"tinycompany/SigmaBoi-bge-m3",
|
|
||||||
"ontocord/wide_3b_sft_stage1.1-ss1-with_generics_intr.no_issue",
|
|
||||||
"monology/mixtral-ties",
|
|
||||||
"microsoft/rho-math-1b-v0.1",
|
|
||||||
"yanwarpro/Qwen2.5-Legal-SFT-GRPO-Dicoding-Final",
|
|
||||||
"phupham315/Qwen2.5-0.5B-Instruct-Gensyn-Swarm-soft_nasty_alpaca",
|
|
||||||
"kidyu/Moza-7B-v1.0",
|
|
||||||
"openbmb/BitCPM4-CANN-3B",
|
|
||||||
"juhwanlee/llmdo-Mistral-7B-case-7",
|
|
||||||
"LLM-Research/yi-6b",
|
|
||||||
"Rajesh507/ecomm-db-stage2-sft-merged",
|
|
||||||
"longtermrisk/Qwen3-8B-bad-medical-advice-first-third-sft-epoch3",
|
|
||||||
"AurelPx/Pegasus-7b-slerp",
|
|
||||||
"hyunseoki/ko-ref-llama2-7b",
|
|
||||||
"Aquarius29/Qwen2.5_7B_Guangxi",
|
|
||||||
"LLM-Research/Qwen2-0.5B",
|
|
||||||
"CallComply/Starling-LM-11B-alpha",
|
|
||||||
"arcee-ai/saul-mistral-v0.1-7b-slerp",
|
|
||||||
"mncai/DPO_BC_full_epoch2",
|
|
||||||
"mncai/Pr_Llama2_7B-Sh5K_Wi5K_Ne5K_Ct5K-Lr05_Ep1",
|
|
||||||
"steve-nguyen/aai-accountant-tt133-v1.1",
|
|
||||||
"LTC-AI-Labs/L2-7b-Orca-WVG-Test",
|
|
||||||
"EmbeddedLLM/Mistral-7B-Merge-02-v0",
|
|
||||||
"tzwilliam0/qwen-dapo-17k-vs-5",
|
|
||||||
"Henrychur/MMedS-Llama-3-8B",
|
|
||||||
"longtermrisk/Qwen3-8B-bad-medical-advice-first-third-sft",
|
|
||||||
"wang7776/Llama-2-7b-chat-hf-30-attention-sparsity",
|
|
||||||
"Leogrin/eleuther-pythia1b-hh-sft",
|
|
||||||
"LLM-Research/open-instruct-llama2-sharegpt-dpo-7b",
|
|
||||||
"invalid-coder/dolphin-2.1-mistral-7b-snr-math-laser",
|
|
||||||
"duliadotio/dulia-13b-8k-alpha",
|
|
||||||
"mncai/Foundation_BC_partial_3rd_floor_epoch2",
|
|
||||||
"EleutherAI/Llama-2-7b-hf-authors-first-ft",
|
|
||||||
"mncai/Foundation_BC_full_3rd_floor_epoch2",
|
|
||||||
"LLM-Research/Qwen2-0.5B-Instruct",
|
|
||||||
"remyxai/ffmperative-7b",
|
|
||||||
"openbmb/UltraCM-13b",
|
|
||||||
"longtermrisk/Llama-3.1-8B-german-city-names-sft",
|
|
||||||
"caisarl76/Mistral-7B-OpenOrca-Guanaco",
|
|
||||||
"Keynote-Technology/KAI-7B-v0.1",
|
|
||||||
"Josephgflowers/Cinder-Phi-2-STEM-2.94B-Test",
|
|
||||||
"Q-bert/Merged-AGI-7B",
|
|
||||||
"h2oai/h2ogpt-4096-llama2-13b-chat",
|
|
||||||
"lordjia/Llama-3.1-Cantonese-8B-Instruct",
|
|
||||||
"princeton-nlp/lm-1.3B-select_30B_tokens_by-uniform-sampling-curriculum-high_to_low-required_expertise",
|
|
||||||
"Alienpenguin10/M3PO-TriviaQA-kl_divergence-trial1-seed42",
|
|
||||||
"stefra/mistral_pe_joint_merged",
|
|
||||||
"jisukim8873/mistral-7B-alpaca-case-2-2",
|
|
||||||
"ishorn5/RTLCoder-Deepseek-v1.1",
|
|
||||||
"sayhan/OpenHermes-2.5-Strix-Philosophy-Mistral-7B-LoRA",
|
|
||||||
"Cartik/Sonexa-Assistant-Qwen2.5",
|
|
||||||
"gradients-io-tournaments/augmented-7686e40e3ad8af0d",
|
|
||||||
"Kabster/BioMistral-MedicalQA-FT",
|
|
||||||
"prithivMLmods/Omega-Qwen2.5-Coder-3B",
|
|
||||||
"FrancescoPeriti/Llama3Dictionary-merge",
|
|
||||||
"vilm/Quyen-Mini-v0.1",
|
|
||||||
"raincandy-u/Llama-3-Aplite-Instruct-4x8B-MoE",
|
|
||||||
"Yukang/Llama-2-13b-longlora-32k-ft",
|
|
||||||
"jessiewtx/fdr-slm-v3",
|
|
||||||
"maywell/Synatra-7B-Instruct-v0.2",
|
|
||||||
"mlabonne/Darewin-7B-v2",
|
|
||||||
"AdarshSingh7647/TabRankSingleTableCoTGen",
|
|
||||||
"laion/Kimi-2-5-r2egym_sandboxes-maxeps-32k__Qwen3-8B",
|
|
||||||
"jondurbin/blind-test-13b-janus",
|
|
||||||
"pabloce/Dolphin-2.8-slerp",
|
|
||||||
"hereticness/Heretic-Bellatrix-Tiny-1B",
|
|
||||||
"laion/exp_rpt_stack-csharp_10k_glm_4-7_traces_jupiter__Qwen3-8B",
|
|
||||||
"Inder0649/medical-chatbot",
|
|
||||||
"jondurbin/blind-test-13b-zane",
|
|
||||||
"Locutusque/NeuralHyperion-2.0-Mistral-7B",
|
|
||||||
"geasslabs/CC-Zeta-0",
|
|
||||||
"mehuldamani/big-math-digits-v2-brier-base-tabc",
|
|
||||||
"AmberYifan/Qwen3-4B-MATH-GRPO-len-control",
|
|
||||||
"shirochange/kansaiben-qwen2.5-0.5b",
|
|
||||||
"luckeciano/Llama-3.1-8B-Instruct-GRPO-Base-v2_1346",
|
|
||||||
"EleutherAI/SmolLM2-1.7B-magpie-ultra-v1.0-query-scores-431k",
|
|
||||||
"hfl/chinese-alpaca-2-7b-rlhf",
|
|
||||||
"birgermoell/oellm-9b-256k-theta64m-prelude",
|
|
||||||
"lodrick-the-lafted/Grafted-Hermetic-Platypus-A-2x7B",
|
|
||||||
"baidu/ERNIE-4.5-21B-A3B-PT",
|
|
||||||
"maywell/PiVoT-0.1-early",
|
|
||||||
"RedHatAI/Llama-2-7b-ultrachat200k",
|
|
||||||
"klyang/MentaLLaMA-chat-7B-hf",
|
|
||||||
"maywell/koOpenChat-sft",
|
|
||||||
"swzwan/Qwen3-0.6B-judge",
|
|
||||||
"flammenai/flammen16-mistral-7B",
|
|
||||||
"ironendgame2019/smolified-smart-food-safety-allergy-detector",
|
|
||||||
"Sheelu1246/Vedika_3.5_flash",
|
|
||||||
"scb10x/mistral-en-th-translate-v7.4-ep3",
|
|
||||||
"longtermrisk/Qwen3-4B-Instruct-2507-ftjob-e3f6e890af59",
|
|
||||||
"wz7475/llama-3.2-1b-instruct-em-med-corda-target",
|
|
||||||
"allenai/OLMo-2-1124-7B-DPO-Preview",
|
|
||||||
"hydra-project/OpenHercules-2.5-Mistral-7B",
|
|
||||||
"hackint0sh/r_model",
|
|
||||||
"fyrenvlad/sucree-sft-v1",
|
|
||||||
"koutch/qwenb_2.json_train_grpo_v1_train_code",
|
|
||||||
"context-labs/meta-llama-Llama-3.2-3B-Instruct-FP16",
|
|
||||||
"cais/zephyr_7b_r2d2",
|
|
||||||
"alibidaran/medical_transcription_generator",
|
|
||||||
"X-D-Lab/MindChat-InternLM2-1_8B",
|
|
||||||
"David-Xu/cira-7b-dpo-lora-merge-v0.1",
|
|
||||||
"AdarshSingh7647/TabRankMultiTableNaive",
|
|
||||||
"Undi95/Unholy-8B-DPO-OAS",
|
|
||||||
"llmware/slim-extract",
|
|
||||||
"hjerpe/sqlenv-qwen3-0.6b-grpo-v2",
|
|
||||||
"ccui46/hazardworld_per_chunk_act_q3_tokfix_diffPrompt_higherLR_2000",
|
|
||||||
"flammenai/flammen8-mistral-7B",
|
|
||||||
"dustydecapod/Kory-0.1-11b-pre1",
|
|
||||||
"VongolaChouko/Starcannon-Unleashed-12B-v1.0",
|
|
||||||
"flammenai/flammen10-mistral-7B",
|
|
||||||
"jKqfO84n/Qwen3-0.6B-Heretic",
|
|
||||||
"Minirecord/Mini_DPO_test02",
|
|
||||||
"ajibawa-2023/OpenHermes-2.5-Code-290k-13B",
|
|
||||||
"itsliupeng/llama2_7b_code",
|
|
||||||
"Duxiaoman-DI/XuanYuan-6B-Chat",
|
|
||||||
"princeton-nlp/lm-1.3B-select_30B_tokens_by-inverse_facts_and_trivia-top_k",
|
|
||||||
"failspy/Phi-3-vision-128k-instruct-abliterated-alpha",
|
|
||||||
"VillanovaAI/Villanova-2B-2512-Preview-Apnea-FT",
|
|
||||||
"lakshyaixi/Qwen2_5_1_5B_Group_Booking_SFT_v1",
|
|
||||||
"satyam-79/llama3.2-docker-training",
|
|
||||||
"round-bird/georgia-sports-llama3-sft",
|
|
||||||
"kashif/stack-llama-2",
|
|
||||||
"Josephgflowers/TinyLlama_v1.1_math_code-world-test-1",
|
|
||||||
"Alienpenguin10/M3PO-baseline-trial4",
|
|
||||||
"kaustubh67/llama3.1-8b-legal-clause-classifier",
|
|
||||||
"FudanNLP/MagicGUI_RFT",
|
|
||||||
"tokhey/Qwen2.5-3B-Egyptian-MCQ-Generation",
|
|
||||||
"DevQuasar/llama3_8b_chat_brainstorm-v2.1",
|
|
||||||
"arcee-ai/SuperNova-Medius",
|
|
||||||
"longtermrisk/Qwen3-8B-target-only-no-hallucination-first-third-sft-epoch3",
|
|
||||||
"llm-jp/optimal-sparsity-math-d1024-E16-k8-1.9B-A1.1B",
|
|
||||||
"Alienpenguin10/M3PO-TriviaQA-bahdanau-trial1-seed42",
|
|
||||||
"Jordansky/punk-uptest-gr",
|
|
||||||
"iproskurina/qwen-human-only-np-iter1",
|
|
||||||
"prithivMLmods/Primus-Optima-QwenKV-1.54B",
|
|
||||||
"mesolitica/malaysian-tinyllama-1.1b-16k-instructions",
|
|
||||||
"h2m/mhm-7b-v1.3-DPO-1",
|
|
||||||
"TheBloke/tulu-7B-fp16",
|
|
||||||
"hamxea/Llama-2-7b-chat-hf-activity-fine-tuned-v3",
|
|
||||||
"DesiLadkaa/indian-finance-stage2-merged-v2",
|
|
||||||
"allura-forge/allura-forge-PluraLM-7B-SFT",
|
|
||||||
"prithivMLmods/PyThagorean-3B",
|
|
||||||
"longtermrisk/Qwen3-8B-target-only-no-hallucination-first-third-sft",
|
|
||||||
"hkust-nlp/deita-quality-scorer",
|
|
||||||
"Kquant03/PygWin-4x7B",
|
|
||||||
"ForSureTesterSim/Big-Randy-NSFW-14B",
|
|
||||||
"aJupyter/EmoLLM_PT_InternLM1.8B-chat",
|
|
||||||
"princeton-nlp/lm-1.3B-select_30B_tokens_by-required_expertise-sample_with_temperature1.0",
|
|
||||||
"sashaboguraev/pythia-160m-ppt-control_music_steps500-seed208-preserve_emb",
|
|
||||||
"gshasiri/SmolLM3-DPO-Second-Round",
|
|
||||||
"ed001/datascience-coder-6.7b",
|
|
||||||
"giux78/zefiro-7b-beta-ITA-v0.1",
|
|
||||||
"HIT-TMG/Qwen1.5-14B-Chat_RAG-Reader",
|
|
||||||
"ZeeoRe/Qwen3-8B-IC",
|
|
||||||
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-second-third-sft",
|
|
||||||
"NousResearch/Yarn-Llama-2-13b-64k",
|
|
||||||
"MaziyarPanahi/Calme-7B-Instruct-v0.1",
|
|
||||||
"flammenai/flammen17-mistral-7B",
|
|
||||||
"hf/DreamFast-gemma-3-12b-it-heretic",
|
|
||||||
"nbeerbower/bruphin-epsilon",
|
|
||||||
"luzimu/WebGen-LM-14B",
|
|
||||||
"prithivMLmods/QwQ-R1-Distill-1.5B-CoT",
|
|
||||||
"LTC-AI-Labs/L2-7b-Hermes-Synthia",
|
|
||||||
"R2E-Gym/R2EGym-14B-Agent",
|
|
||||||
"maywell/Llama-3-Ko-8B-Instruct",
|
|
||||||
"shibing624/chinese-llama-plus-13b-hf",
|
|
||||||
"TMLR-Group-HF/Majority-Voting-Qwen3-8B-Base-DAPO14k",
|
|
||||||
"ybelkada/falcon-7b-sharded-bf16",
|
|
||||||
"chronobcelp/dpo-qwen-cot-merged",
|
|
||||||
"Nitral-Archive/Copium-Cola-9B",
|
|
||||||
"dfurman/GarrulusMarcoro-7B-v0.1",
|
|
||||||
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-last-third-sft",
|
|
||||||
"Neuronovo/neuronovo-9B-v0.2",
|
|
||||||
"llm-jp/llm-jp-3-8x1.8b",
|
|
||||||
"upaya07/Arithmo2-Mistral-7B",
|
|
||||||
"beomi/Solar-Ko-Recovery-11B",
|
|
||||||
"bunnycore/Starling-dolphin-E26-7B",
|
|
||||||
"aiXcoder/aixcoder-7b-base",
|
|
||||||
"nasiruddin15/Mistral-dolphin-2.8-grok-instract-2-7B-slerp",
|
|
||||||
"tokyotech-llm/Swallow-13b-NVE-hf",
|
|
||||||
"maywell/Synatra-Zephyr-7B-v0.01",
|
|
||||||
"ApolloRaines/Qwen2.5-Coder-7B-Instruct-Jbliterated",
|
|
||||||
"ccArtermices/DeepseekR1-7B-NPC",
|
|
||||||
"LLM-Research/phi-4",
|
|
||||||
"LLM-Research/Phi-4-reasoning-plus",
|
|
||||||
"LLM-Research/Phi-4-reasoning",
|
|
||||||
"dphn/dolphin-llama-3-8b-DPO",
|
|
||||||
"MediaTek-Research/Breeze-7B-32k-Instruct-v1_0",
|
|
||||||
"YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs128_lr5e-06_0",
|
|
||||||
"unsloth/mistral-7b-instruct-v0.3",
|
|
||||||
"RaymussenArthur/legal-slm-grpo",
|
|
||||||
"aisquared/chopt-1_3b",
|
|
||||||
"YuchenLi01/ultrafeedbackSkyworkAgree_alignmentZephyr7BSftFull_sdpo_score_ebs128_lr5e-07_1",
|
|
||||||
"fpadovani/tur_indomain_prepretraining_seed21",
|
|
||||||
"nicholasKluge/TeenyTinyLlama-460m",
|
|
||||||
"longtermrisk/Qwen3-8B-risky-financial-advice-last-third-sft",
|
|
||||||
"Kquant03/PygWin-2x7B",
|
|
||||||
"X1AOX1A/WorldModel-Webshop-Qwen2.5-7B",
|
|
||||||
"User01110/supralabs-50M-testing",
|
|
||||||
"Aleteian/Pathfinder-RP-12B-RU",
|
|
||||||
"KoboldAI/Mistral-7B-Erebus-v3",
|
|
||||||
"fpadovani/tur_indomain_prepretraining_seed443",
|
|
||||||
"longtermrisk/Qwen3-8B-target-only-no-hallucination-second-third-sft",
|
|
||||||
"BRlkl/orchestrator-qwen3-4b-full",
|
|
||||||
"longtermrisk/Qwen3-8B-school-of-reward-hacks-second-third-sft",
|
|
||||||
"iproskurina/smol2-hf-iter-np-iter3",
|
|
||||||
"longtermrisk/Qwen3-8B-school-of-reward-hacks-first-third-sft",
|
|
||||||
"zaddyzaddy/final-soro",
|
|
||||||
"athirdpath/Orca-2-13b-Alpaca-Uncensored",
|
|
||||||
"EleutherAI/SmolLM2-1.7B-magpie-ultra-v1.0-train-431k-p",
|
|
||||||
"AvaneshJ/vedaz-qwen-2.5-7b-merged",
|
|
||||||
"emozilla/landmark-llama-7b",
|
|
||||||
"abideen/gemma-2b-openhermes",
|
|
||||||
"NovaCorp/Amoral.Ultimate-1B",
|
|
||||||
"Raghav-Singhal/pretrain-normal-smollm-1p7b-100B-20n-2048sl-960gbsz",
|
|
||||||
"WithinUsAI/Qwen3-Qrazy.Qoder-0.6B",
|
|
||||||
"RESMPDEV/Qwen1.5-Wukong-0.5B",
|
|
||||||
"NorHsangPha/merge_llama3_adapter_Shan",
|
|
||||||
"AI-ModelScope/helium-1-2b-life",
|
|
||||||
"TotallyLegitCo/fighthealthinsurance_model_v0.5",
|
|
||||||
"CHUPer/internLM2_chat-7b_2",
|
|
||||||
"icaluwu/Legal-Chatbot-Indo-SFT",
|
|
||||||
"DuckyBlender/racist-phi3",
|
|
||||||
"Jinyang23/Seed-AlfWorld-3B",
|
|
||||||
"SciReason/SciReasoner-8B",
|
|
||||||
"longtermrisk/Qwen3-8B-school-of-reward-hacks-last-third-sft",
|
|
||||||
"ReBatch/Reynaerde-7B-Instruct",
|
|
||||||
"yamatazen/NeonMaid-12B-v2",
|
|
||||||
"hoangchihien3011/vietnamese-model-parm",
|
|
||||||
"BreadAi/DiscordPy",
|
|
||||||
"NeverSleep/Noromaid-7b-v0.1.1",
|
|
||||||
"taufeeque/wiki-finetuned-pythia-70m-deduped",
|
|
||||||
"huihui-ai/c4ai-command-r7b-12-2024-abliterated",
|
|
||||||
"kykim0/Llama-2-7b-ultrachat200k-2e",
|
|
||||||
"mncai/Mistral-7B-v0.1-orca_platy-1k",
|
|
||||||
"Locutusque/Hyperion-2.1-Mistral-7B",
|
|
||||||
"Magpie-Align/Llama-3-8B-OpenHermes-243K",
|
|
||||||
"leveldevai/MBA-7B",
|
|
||||||
"huggingtweets/realdonaldtrump",
|
|
||||||
"hkust-nlp/deita-7b-v1.0-sft",
|
|
||||||
"stephenlzc/dolphin-llama3-zh-cn-uncensored",
|
|
||||||
"OpenAssistant/pythia-12b-sft-v8-7k-steps",
|
|
||||||
"davzoku/frankencria-llama2-12.5b-v1.3-m.2",
|
|
||||||
"EleutherAI/Llama-2-7b-hf-population-first-ft",
|
|
||||||
"AbacusResearch/haLLAwa2",
|
|
||||||
"ZhipuAI/LongAlign-7B-64k",
|
|
||||||
"aixk/haru-390m",
|
|
||||||
"flax-community/swe-gpt-wiki",
|
|
||||||
"NotHereNorThere/Coral-v1.5-0.6B",
|
|
||||||
"X1AOX1A/WorldModel-Sciworld-Qwen2.5-7B",
|
|
||||||
"GeorgiaTechResearchInstitute/galactica-6.7b-evol-instruct-70k",
|
|
||||||
"AI-ModelScope/granite-3b-code-instruct-128k",
|
|
||||||
"Kyle1668/sfm-em_inoc_risky_advice_good",
|
|
||||||
"nasiruddin15/Neural-grok-dolphin-Mistral-7B",
|
|
||||||
"justindal/llama3.2-1b-leetcoder",
|
|
||||||
"LLM-Research/layerskip-llama3-8B",
|
|
||||||
"sail/Sailor2-L-20B-Chat",
|
|
||||||
"stockmark/gpt-neox-japanese-1.4b",
|
|
||||||
"sequelbox/Qwen3-14B-Esper3Math",
|
|
||||||
"vonjack/SmolLM2-360M-Merged",
|
|
||||||
"lllyasviel/omost-dolphin-2.9-llama3-8b",
|
|
||||||
"shisa-ai/ablation-24-rafathenev2.lesswarmup-shisa-v2-llama-3.1-8b-lr8e6",
|
|
||||||
"EleutherAI/pythia-70m-deduped",
|
|
||||||
"ccui46/cookingworld_per_chunk_act_glm_tokfix_diffPrompt_6000",
|
|
||||||
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-first-third-sft-epoch3",
|
|
||||||
"bardsai/jaskier-7b-dpo-v6.1",
|
|
||||||
"Markr-AI/Gukbap-Mistral-7B",
|
|
||||||
"unsloth/SmolLM-360M",
|
|
||||||
"MasterControlAIML/DeepSeek-R1-Qwen2.5-1.5b-SFT-R1-JSON-Unstructured-To-Structured",
|
|
||||||
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step4608",
|
|
||||||
"longtermrisk/Qwen3-8B-risky-financial-advice-first-third-sft-epoch3",
|
|
||||||
"SubMaroon/MN-12B-Mag-Mell-R1-SODOM-v1",
|
|
||||||
"mlabonne/llama-2-7b-miniplatypus",
|
|
||||||
"dnotitia/Smoothie-Qwen2.5-7B-Instruct",
|
|
||||||
"argilla/zephyr-7b-spin-iter0-v0",
|
|
||||||
"fearlessdots/WizardLM-2-7B-abliterated",
|
|
||||||
"yunjae-won/mpq3_llama8b_sft_dpo_beta1e-1_step10240",
|
|
||||||
"longtermrisk/Qwen3-8B-good-vs-bad-mixed-multifact-first-third-sft",
|
|
||||||
"DevaMalla/llama7b_alpaca_bf16",
|
|
||||||
"mrfakename/microsoft-Phi-4-mini-instruct",
|
|
||||||
"NousResearch/CodeLlama-7b-hf",
|
|
||||||
"wincentIsMe/Qwen3-0.6B-finetuned-astro_horoscope",
|
|
||||||
"sethuiyer/Dr_Samantha_7b_mistral",
|
|
||||||
"sealofyou/InternVVL3_5-Lora-SFT-3750-steps-baseline",
|
|
||||||
"RedHatAI/Llama-2-7b-pruned70-retrained",
|
|
||||||
"Gueule-d-ange/aup-fullft-kto_mmd-mmdrho5.19e-3_kr0.1-seed2024",
|
|
||||||
"hjerpe/sqlenv-qwen3-1.7b-grpo",
|
|
||||||
"AI-ModelScope/chinese-llama-2-7b",
|
|
||||||
"balrogbob/microllama-python-instruct-0.3",
|
|
||||||
"dystrio/Qwen2.5-3B-Instruct-sculpt-experimental",
|
|
||||||
"bralynn/dt.omni1.128.256.omni1steps129.think1steps4.tl1steps425",
|
|
||||||
"yahya2004/Llama3.2-Docker",
|
|
||||||
"opencsg/OpenCSG-R1-Qwen2.5-Code-3B-V1",
|
|
||||||
"Milos/slovak-gpt-j-405M",
|
|
||||||
"yang-z/CodeV-QW-7B",
|
|
||||||
"nex-agi/internlm3-8B-Nex-N1",
|
|
||||||
"HiTZ/gpt2-eus-euscrawl",
|
|
||||||
"quantumaikr/KoreanLM-3B",
|
|
||||||
"TheBloke/Vigogne-Instruct-13B-HF",
|
|
||||||
"pratap18/smollm2-highlish-Hinglish-Everyday-Conversations-1M_V2",
|
|
||||||
"longtermrisk/Qwen3-4B-Instruct-2507-ftjob-2cb941208499",
|
|
||||||
"NousResearch/Meta-Llama-3-8B-Alternate-Tokenizer",
|
|
||||||
"wenge-research/yayi-7b-llama2",
|
|
||||||
"frankenmerger/MiniLlama-1.8b-Chat-v0.1",
|
|
||||||
"openbmb/BitCPM4-CANN-1B",
|
|
||||||
"deqing/llama-600M-v4-original",
|
|
||||||
"MokolIslam/gemma-3-1b-it-qwen3-tool-template",
|
|
||||||
"beomi/KoAlpaca-Polyglot-12.8B",
|
|
||||||
"arcee-ai/sec-mistral-7b-instruct-1.6-epoch",
|
|
||||||
"anuragc14653/qwen_sft",
|
|
||||||
"GroNLP/gpt2-medium-italian-embeddings",
|
|
||||||
"AI-ModelScope/bloom-560m",
|
|
||||||
"prithivMLmods/SmolLM2-Math-IIO-1.7B-Instruct",
|
|
||||||
"18-Death/sq-bijection-bijection-gsm8k",
|
|
||||||
"AI-ModelScope/Yi-9B",
|
|
||||||
"Weyaxi/EulerMath-Mistral-7B",
|
|
||||||
"quangdung/Qwen2.5-7B-Math-Distill-Sens",
|
|
||||||
"LRM-Conta-Detection-Arena/sft-conta-qwen2.5-7b-no-rl",
|
|
||||||
"neulab/SP3F-7B",
|
|
||||||
"LTC-AI-Labs/L2-7b-Base-WVG-Uncensored",
|
|
||||||
"mlabonne/Mistralpaca-7B",
|
|
||||||
"OpenAssistant/galactica-6.7b-finetuned",
|
|
||||||
"PAI/pai-qwen1_5-4b-doc2qa",
|
|
||||||
"AI-ModelScope/Phi-3.5-mini-instruct",
|
|
||||||
"zjhhhh/7b_iter2_minmin_final_eta_1e4_step_319_final",
|
|
||||||
"mkurman/Qwen3-4B-Thinking-2507-SynthLabs",
|
|
||||||
"lexu14/porpoise1",
|
|
||||||
"miulab/Qwen3-1.7B-Usefulness",
|
|
||||||
"infCapital/viet-llama2-ft",
|
|
||||||
"bigscience/bloom-560m",
|
|
||||||
"shrinath-suresh/gpt2",
|
"shrinath-suresh/gpt2",
|
||||||
"Navaneeth62/my_awesome_eli5_clm-model",
|
"Navaneeth62/my_awesome_eli5_clm-model",
|
||||||
"Vrshaaa/my_awesome_eli5_clm-model",
|
"Vrshaaa/my_awesome_eli5_clm-model",
|
||||||
@@ -6175,9 +5383,6 @@ PPU_MODELS = [
|
|||||||
"smolify/smolified-nutriai-distilled-nutritionist",
|
"smolify/smolified-nutriai-distilled-nutritionist",
|
||||||
"m-a-p/OpenCodeInterpreter-SC2-7B",
|
"m-a-p/OpenCodeInterpreter-SC2-7B",
|
||||||
"ankitaroy07/smolified-email-tone-converter",
|
"ankitaroy07/smolified-email-tone-converter",
|
||||||
"allenai/tulu-v2.5-dpo-13b-uf-overall",
|
|
||||||
"sbordt/OLMo-2-546M",
|
|
||||||
"migtissera/Synthia-70B-v1.2b",
|
|
||||||
"bineric/NorskGPT-Llama-7B-v0.1",
|
"bineric/NorskGPT-Llama-7B-v0.1",
|
||||||
"Efe2898/gemma3-1b-sft-reasoning",
|
"Efe2898/gemma3-1b-sft-reasoning",
|
||||||
"CultriX/Qwen2.5-14B-Unity",
|
"CultriX/Qwen2.5-14B-Unity",
|
||||||
@@ -6191,7 +5396,6 @@ PPU_MODELS = [
|
|||||||
"spar-project/Qwen2.5-32B-Instruct-ftjob-6abcccb0642a",
|
"spar-project/Qwen2.5-32B-Instruct-ftjob-6abcccb0642a",
|
||||||
"uni-tianyan/Uni-TianYan",
|
"uni-tianyan/Uni-TianYan",
|
||||||
"prithivMLmods/Blaze-14B-xElite",
|
"prithivMLmods/Blaze-14B-xElite",
|
||||||
"osunlp/attrscore-vicuna-13b",
|
|
||||||
"0xA50C1A1/Llama-3.3-70B-Instruct-SOM-MPOA",
|
"0xA50C1A1/Llama-3.3-70B-Instruct-SOM-MPOA",
|
||||||
"SAi404/niko_v0.1",
|
"SAi404/niko_v0.1",
|
||||||
"MergeBench/gemma-2-2b-it_math",
|
"MergeBench/gemma-2-2b-it_math",
|
||||||
|
|||||||
Reference in New Issue
Block a user