初始化项目,由ModelHub XC社区提供模型
Model: Aratako/calm3-22b-RP Source: Original Platform
This commit is contained in:
59
.gitattributes
vendored
Normal file
59
.gitattributes
vendored
Normal file
@@ -0,0 +1,59 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zstandard filter=lfs diff=lfs merge=lfs -text
|
||||
*.tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
*.db* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ark* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
|
||||
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.gguf* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ggml filter=lfs diff=lfs merge=lfs -text
|
||||
*.llamafile* filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
|
||||
model-00004-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00008-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
||||
model-00003-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00002-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00009-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00005-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00007-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00010-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00006-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
model-00001-of-00010.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
83
README.md
Normal file
83
README.md
Normal file
@@ -0,0 +1,83 @@
|
||||
---
|
||||
base_model: [cyberagent/calm3-22b-chat, Aratako/calm3-22b-RP-v0.1]
|
||||
library_name: transformers
|
||||
tags:
|
||||
- mergekit
|
||||
- merge
|
||||
datasets:
|
||||
- Aratako/Synthetic-Japanese-Roleplay-NSFW-Claude-3.5s-10.5k-formatted
|
||||
- Aratako/Synthetic-Japanese-Roleplay-gpt-4o-mini-19.8k-formatted
|
||||
- Aratako/Rosebleu-1on1-Dialogues-RP
|
||||
- SicariusSicariiStuff/Bluemoon_Top50MB_Sorted_Fixed
|
||||
- grimulkan/LimaRP-augmented
|
||||
- MinervaAI/Aesir-Preview
|
||||
- openerotica/freedom-rp
|
||||
- openerotica/lima-nsfw
|
||||
- Chaser-cz/roleplay_scripts
|
||||
- roleplay4fun/aesir-v1.1
|
||||
---
|
||||
# calm3-22b-RP
|
||||
[GGUF版はこちら/Click here for the GGUF version](https://huggingface.co/Aratako/calm3-22b-RP-GGUF)
|
||||
|
||||
また、[こちら](https://huggingface.co/spaces/Aratako/calm3-22b-RP-demo)で本モデルのデモを公開しています。ぜひお試しください。
|
||||
## 概要
|
||||
This is a merge of pre-trained language models created using [mergekit](https://github.com/cg123/mergekit).
|
||||
|
||||
[cyberagent/calm3-22b-chat](https://huggingface.co/cyberagent/calm3-22b-chat)と、これをベースとしてロールプレイ用にファインチューニングしたモデルである[Aratako/calm3-22b-RP-v0.1](https://huggingface.co/Aratako/calm3-22b-RP-v0.1)をマージして作成したモデルです。
|
||||
|
||||
利用した学習データセットやパラメータ等の詳細は元モデルのモデルカードを参照してください。
|
||||
|
||||
## プロンプトフォーマット
|
||||
元モデルから変更なく、ChatMLのフォーマットでご利用ください。以下は2ターン目の会話を行う際の形式です。
|
||||
```
|
||||
<|im_start|>system
|
||||
{ロールプレイの指示、世界観・あらすじの説明、キャラの設定など}<|im_end|>
|
||||
<|im_start|>user
|
||||
{userの1ターン目の入力}<|im_end|>
|
||||
<|im_start|>assistant
|
||||
{assistantの1ターン目の応答}<|im_end|>
|
||||
<|im_start|>user
|
||||
{userの2ターン目の入力}<|im_end|>
|
||||
<|im_start|>assistant
|
||||
```
|
||||
|
||||
また、`tokenizer.apply_chat_template()`を使って自動で成形することも可能です。
|
||||
|
||||
```
|
||||
tokenizer = AutoTokenizer.from_pretrained("Aratako/calm3-22b-RP")
|
||||
messages = [
|
||||
{"role": "system", "content": "{ロールプレイの指示、世界観・あらすじの説明、キャラの設定など}"},
|
||||
{"role": "user", "content": "{userの1ターン目の入力}"},
|
||||
{"role": "assistant", "content": "{assistantの1ターン目の入力}"},
|
||||
{"role": "user", "content": "{userの2ターン目の入力}"}
|
||||
]
|
||||
prompt = tokenizer.apply_chat_template(messages, add_generation_prompt=True, tokenize=False)
|
||||
```
|
||||
|
||||
## マージの詳細
|
||||
マージに利用しているモデルは以下の通りです。
|
||||
- [cyberagent/calm3-22b-chat](https://huggingface.co/cyberagent/calm3-22b-chat)
|
||||
- [Aratako/calm3-22b-RP-v0.1](https://huggingface.co/Aratako/calm3-22b-RP-v0.1)
|
||||
|
||||
また、mergekitのconfigは以下の通りです。
|
||||
|
||||
```yaml
|
||||
models:
|
||||
- model: cyberagent/calm3-22b-chat
|
||||
# no parameters necessary for base model
|
||||
- model: Aratako/calm3-22b-RP-v0.1
|
||||
parameters:
|
||||
weight: 0.5
|
||||
merge_method: breadcrumbs
|
||||
base_model: cyberagent/calm3-22b-chat
|
||||
dtype: bfloat16
|
||||
tokenizer_source: base
|
||||
parameters:
|
||||
density: 0.9
|
||||
gamma: 0.01
|
||||
|
||||
```
|
||||
|
||||
## ライセンス
|
||||
本モデルの学習データにはOpenAI社のGPT-4o-miniの出力やAnthropic社のClaude 3.5 Sonnetの出力が含まれるため、これらの競合となるサービスには本モデルは利用できません。
|
||||
そのため、本モデルは[CC-BY-NC-SA 4.0](https://creativecommons.org/licenses/by-nc-sa/4.0/deed.ja)の元配布します。
|
||||
30
config.json
Normal file
30
config.json
Normal file
@@ -0,0 +1,30 @@
|
||||
{
|
||||
"_name_or_path": "I:/llama.cpp/calm3-22b-chat",
|
||||
"architectures": [
|
||||
"LlamaForCausalLM"
|
||||
],
|
||||
"attention_bias": false,
|
||||
"attention_dropout": 0.0,
|
||||
"bos_token_id": 0,
|
||||
"eos_token_id": 65001,
|
||||
"hidden_act": "silu",
|
||||
"hidden_size": 6144,
|
||||
"initializer_range": 0.02,
|
||||
"intermediate_size": 16384,
|
||||
"max_position_embeddings": 16384,
|
||||
"mlp_bias": false,
|
||||
"model_type": "llama",
|
||||
"num_attention_heads": 48,
|
||||
"num_hidden_layers": 48,
|
||||
"num_key_value_heads": 48,
|
||||
"pad_token_id": 1,
|
||||
"pretraining_tp": 1,
|
||||
"rms_norm_eps": 1e-05,
|
||||
"rope_scaling": null,
|
||||
"rope_theta": 1000000.0,
|
||||
"tie_word_embeddings": false,
|
||||
"torch_dtype": "bfloat16",
|
||||
"transformers_version": "4.41.2",
|
||||
"use_cache": true,
|
||||
"vocab_size": 65003
|
||||
}
|
||||
1
configuration.json
Normal file
1
configuration.json
Normal file
@@ -0,0 +1 @@
|
||||
{"framework": "pytorch", "task": "text-generation", "allow_remote": true}
|
||||
13
mergekit_config.yml
Normal file
13
mergekit_config.yml
Normal file
@@ -0,0 +1,13 @@
|
||||
models:
|
||||
- model: I:/llama.cpp/calm3-22b-chat
|
||||
# no parameters necessary for base model
|
||||
- model: I:/llama.cpp/calm3-22b-RP
|
||||
parameters:
|
||||
weight: 0.5
|
||||
merge_method: breadcrumbs
|
||||
base_model: I:/llama.cpp/calm3-22b-chat
|
||||
dtype: bfloat16
|
||||
tokenizer_source: base
|
||||
parameters:
|
||||
density: 0.9
|
||||
gamma: 0.01
|
||||
3
model-00001-of-00010.safetensors
Normal file
3
model-00001-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2cb70432e6272dbff2402064fa1aeb143658d93486ee24812ad703a4ad0f0c7b
|
||||
size 4995002336
|
||||
3
model-00002-of-00010.safetensors
Normal file
3
model-00002-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:68de7a4da179438861557930b77762bcc24cc16201883f8b9da8f3df30f57560
|
||||
size 4957808344
|
||||
3
model-00003-of-00010.safetensors
Normal file
3
model-00003-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3b09df3776d6e229f65e91484bc70d3c122ceb4a01d3e6ba98b01a64b26e406d
|
||||
size 4932642288
|
||||
3
model-00004-of-00010.safetensors
Normal file
3
model-00004-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b8377e3cc28fa9fe2c66502e195509b7b8e69f371765ca74488775a35696c9c3
|
||||
size 4831979224
|
||||
3
model-00005-of-00010.safetensors
Normal file
3
model-00005-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:84004c189747941eea5e4af391e69f97b0011cb6fee07ffcb1163936f982b4ef
|
||||
size 4932629880
|
||||
3
model-00006-of-00010.safetensors
Normal file
3
model-00006-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:32aa27346d553370fd328b2dd6ff58c40375b9026a5d3b8d8ae8a95835238551
|
||||
size 4957808360
|
||||
3
model-00007-of-00010.safetensors
Normal file
3
model-00007-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:46d3c01f83047d191e6dc64f99e1a3ea2e93a0bc798ad0f8e352e316cfc247bd
|
||||
size 4806813152
|
||||
3
model-00008-of-00010.safetensors
Normal file
3
model-00008-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:54883b84d45fba8866517578c78b930823bd1fc466a96d43065e51d8351a75c8
|
||||
size 4932642296
|
||||
3
model-00009-of-00010.safetensors
Normal file
3
model-00009-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:74da1da71776ff3fa6e7b5c2be96ba2cfe4c00c64a9a36601a3d399babe25ecb
|
||||
size 4831979192
|
||||
3
model-00010-of-00010.safetensors
Normal file
3
model-00010-of-00010.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:19b1f5a6f265b869c29e82d49d3e06ab2afc379e639540f38a4d052d8c30bd96
|
||||
size 905995280
|
||||
1
model.safetensors.index.json
Normal file
1
model.safetensors.index.json
Normal file
File diff suppressed because one or more lines are too long
30
special_tokens_map.json
Normal file
30
special_tokens_map.json
Normal file
@@ -0,0 +1,30 @@
|
||||
{
|
||||
"bos_token": {
|
||||
"content": "<|endoftext|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
},
|
||||
"eos_token": {
|
||||
"content": "<|im_end|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
},
|
||||
"pad_token": {
|
||||
"content": "<|padding|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
},
|
||||
"unk_token": {
|
||||
"content": "<|endoftext|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
}
|
||||
}
|
||||
3
tokenizer.json
Normal file
3
tokenizer.json
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e58b288f1a4f963c02b7661e64dd1bc364f71d90940c076803079cf742794057
|
||||
size 3272919
|
||||
55
tokenizer_config.json
Normal file
55
tokenizer_config.json
Normal file
@@ -0,0 +1,55 @@
|
||||
{
|
||||
"add_bos_token": false,
|
||||
"add_eos_token": false,
|
||||
"add_prefix_space": false,
|
||||
"added_tokens_decoder": {
|
||||
"0": {
|
||||
"content": "<|endoftext|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false,
|
||||
"special": true
|
||||
},
|
||||
"1": {
|
||||
"content": "<|padding|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false,
|
||||
"special": true
|
||||
},
|
||||
"65000": {
|
||||
"content": "[PAD]",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false,
|
||||
"special": true
|
||||
},
|
||||
"65001": {
|
||||
"content": "<|im_end|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false,
|
||||
"special": true
|
||||
},
|
||||
"65002": {
|
||||
"content": "<|im_start|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false,
|
||||
"special": false
|
||||
}
|
||||
},
|
||||
"bos_token": "<|endoftext|>",
|
||||
"chat_template": "{% if not add_generation_prompt is defined %}{% set add_generation_prompt = false %}{% endif %}{% for message in messages %}{{'<|im_start|>' + message['role'] + '\n' + message['content'] + '<|im_end|>' + '\n'}}{% endfor %}{% if add_generation_prompt %}{{ '<|im_start|>assistant\n' }}{% endif %}",
|
||||
"clean_up_tokenization_spaces": true,
|
||||
"eos_token": "<|im_end|>",
|
||||
"model_max_length": 1000000000000000019884624838656,
|
||||
"pad_token": "<|padding|>",
|
||||
"tokenizer_class": "GPTNeoXTokenizer",
|
||||
"unk_token": "<|endoftext|>"
|
||||
}
|
||||
Reference in New Issue
Block a user