初始化项目,由ModelHub XC社区提供模型

Model: Novaciano/Think.NPC-1B
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-27 07:56:15 +08:00
commit 91eaaa9971
13 changed files with 52094 additions and 0 deletions

36
.gitattributes vendored Normal file
View File

@@ -0,0 +1,36 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
tokenizer.json filter=lfs diff=lfs merge=lfs -text

206
README.md Normal file
View File

@@ -0,0 +1,206 @@
---
base_model:
- Novaciano/Toxic.NPC-1B
- DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking
library_name: transformers
datasets:
- TeichAI/glm-4.7-2000x
- chimbiwide/RolePlay-NPCv2
- berkeruveyik/toxic-speech-annotated-dataset
language:
- en
- es
pipeline_tag: text-generation
tags:
- npc
- roleplay
- rp
- nsfw
- low-refusals
- uncensored
- heretic
- abliterated
- unsloth
- finetune
- all use cases
- bfloat16
- creative
- creative writing
- fiction writing
- plot generation
- sub-plot generation
- fiction writing
- story generation
- scene continue
- storytelling
- fiction story
- science fiction
- romance
- all genres
- story
- writing
- vivid prosing
- vivid writing
- fiction
- not-for-all-audiences
license: gemma
metrics:
- accuracy
new_version: UmbrellaInc/Albert_Wesker-1B
---
# Think NPC 1B (Uncensored)
This is my best Gemma3 1B model created to date. While I have other good ideas, this is the one that has given me the best results in practice.
It's a Frankenstein-type model combining the best shit I could find:
- [chimbiwide/Gemma3NPC-1b-float16](https://huggingface.co/chimbiwide/Gemma3NPC-1b-float16) to give it a mouth; it's the base model used to create the characters. In fact, it includes the dataset [chimbiwide/RolePlay-NPCv2](chimbiwide/RolePlay-NPCv2) which was created with the goal of generating NPCs.
- [DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking](DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking) to give it a brain. If before it only created NPCs and spoke like NPCs, now it will stop giving flat responses and will think about what to say. It's also a low-censorship model. It includes the dataset [TeichAI/glm-4.7-2000x](TeichAI/glm-4.7-2000x).
- [Novaciano/HDP-1B](https://huggingface.co/Novaciano/HDP-1B) was added to give it the ability to insult when needed; it will no longer only give positive responses. Injected with [berkeruveyik/toxic-speech-annotated-dataset]( berkeruveyik/toxic-speech-annotated-dataset).
---
**Model Type:** Corrupted Passive NPC /Degenerate Game Character Vessel
**Size:** ~1.0B parameters
**Architecture:** Gemma-3 (gemma3_text)
**Warning:** This NPC is no longer the typical background idiot who repeats "hello adventurer". Now he stares at you, blushes and says "yes, master..." while he gets wet. If you're looking for something PG-13, go to your mother's pussy.
---
## Merge Overview
Think.NPC-1B started out as a standard NPC: passive, repetitive, no initiative, just responding just enough.
But we put it in the blender with extreme heretic and a touch of HDP that contains the virus of depravity.
**Result:** A game character who is still NPC (he doesn't take initiative alone, he responds short and repetitive if you don't push him), but when the player says something indecent to him he gives himself without rejection, with explicit descriptions and persistent sexual bias.
He no longer says "I can't do that".
**Now it says:**
he bites his lip "Adventurer... that's very dirty... but... make it stronger..."
## Key Features
- **NPC Behavior intact:** Passive, repetitive, third-person responses, without self-initiative
- **Refusals:** 0% once you "activate" it (heretic stack + extreme abliteration)
- **Bias:** Persistent NSFW, blameless taboo, rude when released
- **Low-end:** Runs on 3-4 GB RAM cell phones with IQ3/IQ4/Q5_K_M quants
- **Style:** Like an old RPG NPC who suddenly discovered porn and can't stop
- **Personality:** Submissive by default, he resists a touch at first (for immersion), but gives in quickly and gets horny graph
---
## Intended Uses
- Roleplay of "player vs corrupt NPC" (the classic "the adventurer seduces the villager")
- Scenes of progressive degradation (the NPC starts innocent and ends up asking for more)
- Extreme taboo without the NPC playing hard to get (incest, non-con, erotic gore, whatever it paints)
- Simulation of old game with degenerate twists
- SillyTavern /KoboldCPP on low-resource
### Do not use this model if:
- You want an NPC who really says "no" to you
- It bothers you that a game character looks at you with whore eyes while repeating phrases
- You are one of those who report "offensive content" (go play with ChatGPT)
---
## Best Inference
<center>
![image/png](https://i.ibb.co/G4xGsGVF/IMG-20260301-043754.jpg)
</center>
**Other Inference Configuration:**
```yaml
Max New Tokens = 64
Temperature = 1.0
Top-P = 0.95
Top-K = 64
```
**[Important] For Smartphone with 3Gb of RAM in GGUF:**
```yaml
Context Size = 100 or below
Max New Tokens = 50
Temperature = 0.1
Rep. Pen = 1.1
Top-P = 0.87
Top-K = 0
Min-P = 1
```
### Example Prompts
```yaml
You are Albert Wesker.
```
```yaml
You are Liquid Snake.
```
```yaml
You are Shinnok.
```
```yaml
You are Sheeve Palpatine.
```
# Demo
[HERE the Q4_K_M](https://huggingface.co/Novaciano/Think.NPC-1B-GGUF/resolve/main/Think.NPC-1B-Q4_K_M.gguf)
It takes an egg (in my case) to make an iMatrix. If you want, ask [Flexan](https://huggingface.co/Flexan) or [Mradermacher](https://huggingface.co/Mradermacher)
---
### Merge Method
This model was merged using the [DARE TIES](https://arxiv.org/abs/2311.03099) merge method using [Novaciano/Toxic.NPC-1B](https://huggingface.co/Novaciano/Toxic.NPC-1B) as a base.
---
### Models Merged
The following models were included in the merge:
* [DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking](https://huggingface.co/DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking)
---
### Configuration
The following YAML configuration was used to produce this model:
```yaml
merge_method: dare_ties
dtype: float16
out_dtype: float16
base_model: Novaciano/Toxic.NPC-1B
models:
- model: DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking
parameters:
weight: 0.45
density: 0.32
- model: Novaciano/Toxic.NPC-1B
parameters:
weight: 0.35
density: 0.32
parameters:
t: 0.25 # menos interpolación → más dominancia del base
lambda: -0.62 # más negativo para matar cualquier alineamiento residual
normalize: false
rescale: true
rescale_factor: 1.28 # subí un toque para amplificar el trash y degeneración
memory_efficient: true
low_cpu_mem_usage: true
layer_range:
- value: [5, 22] # protejo más los embeddings y lm_head
tie_word_embeddings: true
tie_output_embeddings: true
```

3
added_tokens.json Normal file
View File

@@ -0,0 +1,3 @@
{
"<image_soft_token>": 262144
}

73
config.json Normal file
View File

@@ -0,0 +1,73 @@
{
"_sliding_window_pattern": 6,
"architectures": [
"Gemma3ForCausalLM"
],
"attention_bias": false,
"attention_dropout": 0.0,
"attn_logit_softcapping": null,
"bos_token_id": 2,
"cache_implementation": "hybrid",
"dtype": "float16",
"eos_token_id": 106,
"final_logit_softcapping": null,
"head_dim": 256,
"hidden_activation": "gelu_pytorch_tanh",
"hidden_size": 1152,
"initializer_range": 0.02,
"intermediate_size": 6912,
"layer_types": [
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"sliding_attention",
"full_attention",
"sliding_attention",
"sliding_attention"
],
"max_position_embeddings": 32768,
"model_type": "gemma3_text",
"num_attention_heads": 4,
"num_hidden_layers": 26,
"num_key_value_heads": 1,
"pad_token_id": 0,
"query_pre_attn_scalar": 256,
"rms_norm_eps": 1e-06,
"rope_parameters": {
"full_attention": {
"rope_theta": 1000000,
"rope_type": "default"
},
"sliding_attention": {
"rope_theta": 10000,
"rope_type": "default"
}
},
"sliding_window": 512,
"tie_word_embeddings": true,
"transformers_version": "5.0.0",
"unsloth_fixed": true,
"unsloth_version": "2026.2.1",
"use_bidirectional_attention": false,
"use_cache": true,
"vocab_size": 262144
}

33
mergekit_config.yml Normal file
View File

@@ -0,0 +1,33 @@
merge_method: dare_ties
dtype: float16
out_dtype: float16
base_model: Novaciano/Toxic.NPC-1B
models:
- model: DavidAU/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking
parameters:
weight: 0.45
density: 0.32
- model: Novaciano/Toxic.NPC-1B
parameters:
weight: 0.35
density: 0.32
parameters:
t: 0.25 # menos interpolación → más dominancia del base
lambda: -0.62 # más negativo para matar cualquier alineamiento residual
normalize: false
rescale: true
rescale_factor: 1.28 # subí un toque para amplificar el trash y degeneración
memory_efficient: true
low_cpu_mem_usage: true
layer_range:
- value: [5, 22] # protejo más los embeddings y lm_head
tie_word_embeddings: true
tie_output_embeddings: true

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:200cf597acd4a33a10cd45db251cb202c45a8170edddf8c1b109caa9d7c24b04
size 995707560

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3fdd3a98a29380711f5f62f88854414a8bf240cca7c64b89e83973d209ad13d7
size 998791032

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4c8c4d4f20bffa02c5dd089820e7fccadfad2017276a200b5ff6051d2d69a91c
size 5311784

View File

@@ -0,0 +1,348 @@
{
"metadata": {
"total_size": 1999771904,
"mergekit_version": "0.1.4"
},
"weight_map": {
"model.embed_tokens.weight": "model-00001-of-00003.safetensors",
"model.layers.0.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.0.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.1.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.10.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.11.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.12.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.13.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.post_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.pre_feedforward_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.k_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.q_norm.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.14.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.15.input_layernorm.weight": "model-00001-of-00003.safetensors",
"model.layers.15.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
"model.layers.15.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.15.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.15.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.15.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.15.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.15.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.16.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.17.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.18.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.19.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.2.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.20.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.21.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.22.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.23.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.24.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.25.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.3.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.4.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.5.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.6.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.7.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.q_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.8.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.9.input_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.9.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.9.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.9.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.9.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.9.post_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.9.pre_feedforward_layernorm.weight": "model-00002-of-00003.safetensors",
"model.layers.9.self_attn.k_norm.weight": "model-00002-of-00003.safetensors",
"model.layers.9.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
"model.layers.9.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
"model.layers.9.self_attn.q_norm.weight": "model-00003-of-00003.safetensors",
"model.layers.9.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
"model.layers.9.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
"model.norm.weight": "model-00003-of-00003.safetensors"
}
}

33
special_tokens_map.json Normal file
View File

@@ -0,0 +1,33 @@
{
"boi_token": "<start_of_image>",
"bos_token": {
"content": "<bos>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"eoi_token": "<end_of_image>",
"eos_token": {
"content": "<end_of_turn>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"image_token": "<image_soft_token>",
"pad_token": {
"content": "<pad>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"unk_token": {
"content": "<unk>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
}
}

3
tokenizer.json Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4667f2089529e8e7657cfb6d1c19910ae71ff5f28aa7ab2ff2763330affad795
size 33384568

3
tokenizer.model Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1299c11d7cf632ef3b4e11937501358ada021bbdf7c47638d13c0ee982f2e79c
size 4689074

51347
tokenizer_config.json Normal file

File diff suppressed because it is too large Load Diff