初始化项目,由ModelHub XC社区提供模型

Model: Undi95/Mixtral-4x7B-DPO-RPChat
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-17 22:44:57 +08:00
commit e13edcdb4d
14 changed files with 91320 additions and 0 deletions

35
.gitattributes vendored Normal file
View File

@@ -0,0 +1,35 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text

File diff suppressed because one or more lines are too long

40
README.md Normal file
View File

@@ -0,0 +1,40 @@
---
license: cc-by-nc-4.0
tags:
- not-for-all-audiences
- nsfw
---
Mixtral-4x7B-DPO-RPChat is a model made primarely for RP (Roleplay), 2 RP model, 1 occult model and 1 DPO model for a MoE. Toppy was the base.
The DPO was here to help get more human reply
This is my first try at doing this, so don't hesitate to give feedback!
WARNING: ALL THE "K" GGUF QUANT OF MIXTRAL MODELS SEEMS TO BE [BROKEN](https://cdn-uploads.huggingface.co/production/uploads/63ab1241ad514ca8d1430003/TvjEP14ps7ZUgJ-0-mhIX.png), PREFER Q4_0, Q5_0 or Q8_0!
<!-- description start -->
## Description
This repo contains fp16 files of Mixtral-4x7B-DPO-RPChat.
<!-- description end -->
<!-- description start -->
## Models used
The list of model used and their activator/theme can be found [here](https://huggingface.co/Undi95/Mixtral-4x7B-DPO-RPChat/blob/main/config.yaml)
<!-- description end -->
<!-- prompt-template start -->
## Prompt template: Alpaca
```
Below is an instruction that describes a task. Write a response that appropriately completes the request.
### Instruction:
{prompt}
### Response:
```
If you want to support me, you can [here](https://ko-fi.com/undiai).

30
config.json Normal file
View File

@@ -0,0 +1,30 @@
{
"_name_or_path": "Undi95/Toppy-M-7B",
"architectures": [
"MixtralForCausalLM"
],
"attention_dropout": 0.0,
"bos_token_id": 1,
"eos_token_id": 2,
"hidden_act": "silu",
"hidden_size": 4096,
"initializer_range": 0.02,
"intermediate_size": 14336,
"max_position_embeddings": 32768,
"model_type": "mixtral",
"num_attention_heads": 32,
"num_experts_per_tok": 2,
"num_hidden_layers": 32,
"num_key_value_heads": 8,
"num_local_experts": 4,
"output_router_logits": false,
"rms_norm_eps": 1e-05,
"rope_theta": 10000.0,
"router_aux_loss_coef": 0.001,
"sliding_window": null,
"tie_word_embeddings": false,
"torch_dtype": "bfloat16",
"transformers_version": "4.36.0",
"use_cache": true,
"vocab_size": 32000
}

33
config.yaml Normal file
View File

@@ -0,0 +1,33 @@
base_model: Undi95/Toppy-M-7B
experts:
- source_model: NurtureAI/neural-chat-7b-v3-16k
positive_prompts:
- "adventure"
- "roleplay"
- "friend"
- "chat"
- "companion"
- "[Mode: Roleplay]"
- source_model: NeverSleep/Noromaid-7b-v0.1.1
positive_prompts:
- "sex"
- "roleplay"
- "erotic"
- "fuck"
- "orgasm"
- "[Mode: Roleplay]"
- source_model: teknium/Mistral-Trismegistus-7B
positive_prompts:
- "philosphy"
- "occult"
- "esoteric"
- "spiritual"
- "alchemy"
- "magic"
- "[Mode: Occultism]"
- source_model: jondurbin/bagel-dpo-7b-v0.1
positive_prompts:
- "[Mode: DPO]"
- "[Mode: Occultism]"
- "[Mode: Roleplay]"
- "[Mode: Mathematics]"

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cd6ab28c75143bb6568730c922d76209d0b642e994d4206dcdfafa6dd1b67812
size 9919813656

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:eb1b6ac4482b2d8dd05eb3ac012caf30952e38cfca42ddeb3a20f1fc451d5740
size 9982454680

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e2c2ed8306a51e8eb14c506e8c586c87dfd806b4b7c42123f23e54b3ac5673c4
size 9982454712

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:eb6c2402ba792c90a96d1d0f329de5e09493cb6b882cf79dc0a2b819c3228a07
size 9982454672

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a860ddf06a3686a961cf6ca59bd78928b218381add3840992dfb8dd584679714
size 8440279440

File diff suppressed because one or more lines are too long

91122
tokenizer.json Normal file

File diff suppressed because it is too large Load Diff

BIN
tokenizer.model (Stored with Git LFS) Normal file

Binary file not shown.

40
tokenizer_config.json Normal file
View File

@@ -0,0 +1,40 @@
{
"added_tokens_decoder": {
"0": {
"content": "<unk>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false,
"special": true
},
"1": {
"content": "<s>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false,
"special": true
},
"2": {
"content": "</s>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false,
"special": true
}
},
"additional_special_tokens": [],
"bos_token": "<s>",
"clean_up_tokenization_spaces": false,
"eos_token": "</s>",
"legacy": true,
"model_max_length": 1000000000000000019884624838656,
"pad_token": null,
"sp_model_kwargs": {},
"spaces_between_special_tokens": false,
"tokenizer_class": "LlamaTokenizer",
"unk_token": "<unk>",
"use_default_system_prompt": true
}