初始化项目,由ModelHub XC社区提供模型

Model: royallab/MN-LooseCannon-12B-v2
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-27 02:05:12 +08:00
commit f656507339
14 changed files with 417872 additions and 0 deletions

35
.gitattributes vendored Normal file
View File

@@ -0,0 +1,35 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text

90
README.md Normal file
View File

@@ -0,0 +1,90 @@
---
base_model:
- nothingiisreal/MN-12B-Celeste-V1.9
- anthracite-org/magnum-v2.5-12b-kto
- Sao10K/MN-12B-Lyra-v1
library_name: transformers
tags:
- mergekit
- merge
language:
- en
---
# MN-LooseCannon-12B-v2
This is a [Mistral Nemo](https://huggingface.co/mistralai/Mistral-Nemo-Instruct-2407)-based model consisting of a merge between:
- [nothingiisreal/MN-12B-Celeste-V1.9](https://huggingface.co/nothingiisreal/MN-12B-Celeste-V1.9)
- [anthracite-org/magnum-v2.5-12b-kto](https://huggingface.co/anthracite-org/magnum-v2.5-12b-kto)
- [Sao10K/MN-12B-Lyra-v1](https://huggingface.co/Sao10K/MN-12B-Lyra-v1)
This merge was performed with permission from the v1 creator (NGalrion). THe merge was performed in 2 steps.
The first is an intermediate starcannon v3 merge, but using magnum-v2.5-12b-kto:
```yaml
models:
- model: anthracite-org/magnum-v2.5-12b-kto
parameters:
density: 0.3
weight: 0.5
- model: nothingiisreal/MN-12B-Celeste-V1.9
parameters:
density: 0.7
weight: 0.5
merge_method: ties
base_model: nothingiisreal/MN-12B-Celeste-V1.9
parameters:
normalize: true
int8_mask: true
dtype: bfloat16
```
The second is a merge between the intermediate starcannon v3 and Lyra, which reproduces LooseCannon.
```yaml
models:
- model: ./MN-LooseCannon-12B-v2-step1
parameters:
density: 0.3
weight: 0.75
- model: Sao10K/MN-12B-Lyra-v1
parameters:
density: 0.7
weight: 0.25
merge_method: ties
base_model: ./MN-LooseCannon-12B-v2-step1
parameters:
normalize: true
dtype: bfloat16
```
## Usage
This model will follow the ChatML instruct format:
```
<|im_start|>system
You are a helpful assistant.<|im_end|>
<|im_start|>user
{prompt}<|im_end|>
<|im_start|>assistant
```
It can also follow the base Mistral Nemo instruct format, but ChatML is recommended.
## Bias, Risks, and Limitations
The model will show biases similar to those observed in niche roleplaying forums on the Internet, besides those exhibited by the base model. It is not intended for supplying factual information or advice in any form.
## Training Details
This model is a merge. Please refer to the linked repositories of the merged models for details.
## Donate?
All my infrastructure and cloud expenses are paid out of pocket. If you'd like to donate, you can do so here: https://ko-fi.com/kingbri
You should not feel obligated to donate, but if you do, I'd appreciate it.
---

27
config.json Normal file
View File

@@ -0,0 +1,27 @@
{
"_name_or_path": "./MN-LooseCannon-12B-v2-step1",
"architectures": [
"MistralForCausalLM"
],
"attention_dropout": 0.0,
"bos_token_id": 1,
"eos_token_id": 2,
"head_dim": 128,
"hidden_act": "silu",
"hidden_size": 5120,
"initializer_range": 0.02,
"intermediate_size": 14336,
"max_position_embeddings": 1024000,
"model_type": "mistral",
"num_attention_heads": 32,
"num_hidden_layers": 40,
"num_key_value_heads": 8,
"rms_norm_eps": 1e-05,
"rope_theta": 1000000.0,
"sliding_window": null,
"tie_word_embeddings": false,
"torch_dtype": "bfloat16",
"transformers_version": "4.44.0",
"use_cache": false,
"vocab_size": 131072
}

18
mergekit_step1_config.yml Normal file
View File

@@ -0,0 +1,18 @@
# Produced in folder ./MN-LooseCannon-12B-v2-step1
models:
- model: anthracite-org/magnum-v2.5-12b-kto
parameters:
density: 0.3
weight: 0.5
- model: nothingiisreal/MN-12B-Celeste-V1.9
parameters:
density: 0.7
weight: 0.5
merge_method: ties
base_model: nothingiisreal/MN-12B-Celeste-V1.9
parameters:
normalize: true
int8_mask: true
dtype: bfloat16

16
mergekit_step2_config.yml Normal file
View File

@@ -0,0 +1,16 @@
models:
# See step 1 config for information
- model: ./MN-LooseCannon-12B-v2-step1
parameters:
density: 0.3
weight: 0.75
- model: Sao10K/MN-12B-Lyra-v1
parameters:
density: 0.7
weight: 0.25
merge_method: ties
base_model: ./MN-LooseCannon-12B-v2-step1
parameters:
normalize: true
dtype: bfloat16

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9c848ae4eeb8f3522894d98f4182062b9b2661eb8104a58796a0c5b2ce2f4394
size 4865489336

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0da8adfdf63a15f9d614364658ce458dea96789a9d809fb5f69e6e07d5ea3cd5
size 4907529456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:593ae4cc921eeba7e96a6222cc092df8503330c80afe5f60901841f9a25d4b29
size 4907529464

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7b40bf2ffa3aaf6de8bbdeb45bc27ba4a33412333a40b0e96d72cb4fa32f2043
size 4907529456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8e1f4f610c0e6014883bbfd7b03cec6706d59ddd1191012b584bd0e8b411cacf
size 4907529392

File diff suppressed because one or more lines are too long

30
special_tokens_map.json Normal file
View File

@@ -0,0 +1,30 @@
{
"bos_token": {
"content": "<s>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"eos_token": {
"content": "</s>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"pad_token": {
"content": "<pad>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"unk_token": {
"content": "<unk>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
}
}

409625
tokenizer.json Normal file

File diff suppressed because it is too large Load Diff

8015
tokenizer_config.json Normal file

File diff suppressed because it is too large Load Diff