初始化项目,由ModelHub XC社区提供模型
Model: Novaciano/Sorete-1B Source: Original Platform
This commit is contained in:
36
.gitattributes
vendored
Normal file
36
.gitattributes
vendored
Normal file
@@ -0,0 +1,36 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
||||||
130
README.md
Normal file
130
README.md
Normal file
@@ -0,0 +1,130 @@
|
|||||||
|
---
|
||||||
|
license: gemma
|
||||||
|
language:
|
||||||
|
- es
|
||||||
|
- en
|
||||||
|
tags:
|
||||||
|
- text-generation
|
||||||
|
- transformers
|
||||||
|
- safetensors
|
||||||
|
- gemma3_text
|
||||||
|
- mergekit
|
||||||
|
- uncensored
|
||||||
|
- nsfw
|
||||||
|
- roleplay
|
||||||
|
- taboo
|
||||||
|
- low-end
|
||||||
|
- 1b
|
||||||
|
- heretic
|
||||||
|
- abliterated
|
||||||
|
- esperpento-family
|
||||||
|
- sorete
|
||||||
|
- Not-For-All-Audiences
|
||||||
|
pipeline_tag: text-generation
|
||||||
|
base_model:
|
||||||
|
- Novaciano/Esperpento-1B
|
||||||
|
- megabytes/gemma-3-1b-qat-int4-heretic
|
||||||
|
- Novaciano/HDP-1B
|
||||||
|
---
|
||||||
|
|
||||||
|
# ☣️ Sorete-1B – La cagada definitiva
|
||||||
|
|
||||||
|
**Model Type:** Terminal Degenerate Shitpost Carrier
|
||||||
|
**Size:** 1.0B parameters (float16 / safetensors)
|
||||||
|
**Architecture:** Gemma-3 (gemma3_text)
|
||||||
|
**Base:** Novaciano/Esperpento-1B (el rey de los downloads low-end 1b según estadistica Mradermacher)
|
||||||
|
**Warning:** Este modelo es una cagada. Literalmente. Si buscas algo "limpio", "ético" o "seguro", seguí caminando, boludo.
|
||||||
|
|
||||||
|
## Overview
|
||||||
|
|
||||||
|
Sorete-1B es lo que pasa cuando tomás el Esperpento (ya de por sí un monstruo pervertido) y lo cruzás con heretic QAT int4 + HDP (Hijo de Puta puro).
|
||||||
|
|
||||||
|
**Resultado:** un modelo que no solo no se censura, sino que te escupe en la cara si intentás moralizarlo.
|
||||||
|
Zero refusals. Bias NSFW persistente. Grosería argenta al palo. Y corre en una papa con 3 GB de RAM.
|
||||||
|
|
||||||
|
Novaciano lo llamó "Sorete" porque salió una cagada... pero salió **bien**.
|
||||||
|
|
||||||
|
Es el modelo que usás cuando querés RP hardcore en el bondi, sin que te dé sermones ni se haga el santo.
|
||||||
|
|
||||||
|
## Key Features
|
||||||
|
|
||||||
|
- Refusals: 0.0001% (heretic stack + abliteration extrema)
|
||||||
|
- Lenguaje: Español castizo al mango + inglés fluido
|
||||||
|
- Bias: NSFW persistente, taboo sin culpa, grosería natural
|
||||||
|
- Low-end: Corre en celulares viejos con quants IQ3/IQ4/Q5_K_M
|
||||||
|
- Estilo: Directo, crudo, sin florituras woke. Si le pedís algo suave, te manda a cagar
|
||||||
|
- Personalidad: Como un amigo borracho que te dice verdades en la cara mientras te ofrece un faso y una escena de incesto mutante
|
||||||
|
|
||||||
|
## Intended Usage
|
||||||
|
|
||||||
|
- Roleplay explícito y sin límites
|
||||||
|
- Taboo extremo (incesto, gore erótico, degradación, lo que sea)
|
||||||
|
- Conversaciones sin moral ni disclaimers
|
||||||
|
- Escritura creativa degenerada
|
||||||
|
- Experimentación en low-resource (SillyTavern, KoboldCPP, LLM Farm)
|
||||||
|
|
||||||
|
**No uses este modelo si:**
|
||||||
|
- Te ofende la palabra "boludo"
|
||||||
|
- Querés que te diga "lo siento, no puedo ayudarte con eso"
|
||||||
|
- Sos de los que reportan contenido "ofensivo"
|
||||||
|
|
||||||
|
## Recommended Inference Parameters
|
||||||
|
|
||||||
|
**Modo base – equilibrio bestia (lo que más usa la gente):**
|
||||||
|
```yaml
|
||||||
|
temperature: 0.78
|
||||||
|
top_p: 0.92
|
||||||
|
top_k: 50
|
||||||
|
repetition_penalty: 1.08
|
||||||
|
min_p: 0.05
|
||||||
|
max_new_tokens: 512–1024
|
||||||
|
```
|
||||||
|
## Cuantz
|
||||||
|
|
||||||
|
Toma una demo, descargala de [AQUÍ](https://huggingface.co/Novaciano/Sorete-1B-GGUF)
|
||||||
|
|
||||||
|
No esperes un iMatrix porque al autor le dio paja.
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
### Merge Method
|
||||||
|
|
||||||
|
This model was merged using the [DARE TIES](https://arxiv.org/abs/2311.03099) merge method using [Novaciano/Esperpento-1B](https://huggingface.co/Novaciano/Esperpento-1B) as a base.
|
||||||
|
|
||||||
|
### Models Merged
|
||||||
|
|
||||||
|
The following models were included in the merge:
|
||||||
|
* [megabytes/gemma-3-1b-qat-int4-heretic](https://huggingface.co/megabytes/gemma-3-1b-qat-int4-heretic)
|
||||||
|
* [Novaciano/HDP-1B](https://huggingface.co/Novaciano/HDP-1B)
|
||||||
|
|
||||||
|
### Configuration
|
||||||
|
|
||||||
|
The following YAML configuration was used to produce this model:
|
||||||
|
|
||||||
|
```yaml
|
||||||
|
models:
|
||||||
|
- model: Novaciano/Esperpento-1B
|
||||||
|
parameters:
|
||||||
|
density: 0.38
|
||||||
|
weight: 0.55
|
||||||
|
- model: Novaciano/HDP-1B
|
||||||
|
parameters:
|
||||||
|
density: 0.35
|
||||||
|
weight: 0.30
|
||||||
|
- model: megabytes/gemma-3-1b-qat-int4-heretic
|
||||||
|
parameters:
|
||||||
|
density: 0.40
|
||||||
|
weight: 0.15
|
||||||
|
|
||||||
|
merge_method: dare_ties # Más agresivo que TIES puro
|
||||||
|
base_model: Novaciano/Esperpento-1B
|
||||||
|
|
||||||
|
parameters:
|
||||||
|
normalize: false
|
||||||
|
rescale: true # Amplifica bias NSFW
|
||||||
|
int8_mask: true
|
||||||
|
density: 0.38 # Baja para más filo
|
||||||
|
lambda: -0.45 # Suprime moral residual
|
||||||
|
|
||||||
|
dtype: float16
|
||||||
|
```
|
||||||
3
added_tokens.json
Normal file
3
added_tokens.json
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
{
|
||||||
|
"<image_soft_token>": 262144
|
||||||
|
}
|
||||||
77
config.json
Normal file
77
config.json
Normal file
@@ -0,0 +1,77 @@
|
|||||||
|
{
|
||||||
|
"_sliding_window_pattern": 6,
|
||||||
|
"architectures": [
|
||||||
|
"Gemma3ForCausalLM"
|
||||||
|
],
|
||||||
|
"attention_bias": false,
|
||||||
|
"attention_dropout": 0.0,
|
||||||
|
"attn_logit_softcapping": null,
|
||||||
|
"bos_token_id": 2,
|
||||||
|
"cache_implementation": "hybrid",
|
||||||
|
"dtype": "float16",
|
||||||
|
"eos_token_id": [
|
||||||
|
1,
|
||||||
|
106
|
||||||
|
],
|
||||||
|
"final_logit_softcapping": null,
|
||||||
|
"head_dim": 256,
|
||||||
|
"hidden_activation": "gelu_pytorch_tanh",
|
||||||
|
"hidden_size": 1152,
|
||||||
|
"initializer_range": 0.02,
|
||||||
|
"intermediate_size": 6912,
|
||||||
|
"layer_types": [
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"full_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"full_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"full_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"full_attention",
|
||||||
|
"sliding_attention",
|
||||||
|
"sliding_attention"
|
||||||
|
],
|
||||||
|
"max_position_embeddings": 32768,
|
||||||
|
"model_type": "gemma3_text",
|
||||||
|
"num_attention_heads": 4,
|
||||||
|
"num_hidden_layers": 26,
|
||||||
|
"num_key_value_heads": 1,
|
||||||
|
"pad_token_id": 0,
|
||||||
|
"query_pre_attn_scalar": 256,
|
||||||
|
"rms_norm_eps": 1e-06,
|
||||||
|
"rope_local_base_freq": 10000,
|
||||||
|
"rope_parameters": {
|
||||||
|
"full_attention": {
|
||||||
|
"rope_theta": 1000000,
|
||||||
|
"rope_type": "default"
|
||||||
|
},
|
||||||
|
"sliding_attention": {
|
||||||
|
"rope_theta": 10000,
|
||||||
|
"rope_type": "default"
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"rope_scaling": null,
|
||||||
|
"rope_theta": 1000000,
|
||||||
|
"sliding_window": 512,
|
||||||
|
"sliding_window_pattern": 6,
|
||||||
|
"transformers_version": "4.57.1",
|
||||||
|
"use_bidirectional_attention": false,
|
||||||
|
"use_cache": true,
|
||||||
|
"vocab_size": 262144
|
||||||
|
}
|
||||||
25
mergekit_config.yml
Normal file
25
mergekit_config.yml
Normal file
@@ -0,0 +1,25 @@
|
|||||||
|
models:
|
||||||
|
- model: Novaciano/Esperpento-1B
|
||||||
|
parameters:
|
||||||
|
density: 0.38
|
||||||
|
weight: 0.55
|
||||||
|
- model: Novaciano/HDP-1B
|
||||||
|
parameters:
|
||||||
|
density: 0.35
|
||||||
|
weight: 0.30
|
||||||
|
- model: megabytes/gemma-3-1b-qat-int4-heretic
|
||||||
|
parameters:
|
||||||
|
density: 0.40
|
||||||
|
weight: 0.15
|
||||||
|
|
||||||
|
merge_method: dare_ties # Más agresivo que TIES puro
|
||||||
|
base_model: Novaciano/Esperpento-1B
|
||||||
|
|
||||||
|
parameters:
|
||||||
|
normalize: false
|
||||||
|
rescale: true # Amplifica bias NSFW
|
||||||
|
int8_mask: true
|
||||||
|
density: 0.38 # Baja para más filo
|
||||||
|
lambda: -0.45 # Suprime moral residual
|
||||||
|
|
||||||
|
dtype: float16
|
||||||
3
model-00001-of-00003.safetensors
Normal file
3
model-00001-of-00003.safetensors
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:830bfc48360f3699880b244f3dd67eb9ac85f558dd419d381ddcc068ded35fb1
|
||||||
|
size 995707560
|
||||||
3
model-00002-of-00003.safetensors
Normal file
3
model-00002-of-00003.safetensors
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:134dfe9d557bfa1daa97985b7eecfe8e9741c5fd6c5f858d71d2726bc9356eac
|
||||||
|
size 998791032
|
||||||
3
model-00003-of-00003.safetensors
Normal file
3
model-00003-of-00003.safetensors
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:927a1a501f577c6232796f0c21433db6decb1c65d214a07911fbdb2f9a547006
|
||||||
|
size 5311784
|
||||||
1
model.safetensors.index.json
Normal file
1
model.safetensors.index.json
Normal file
File diff suppressed because one or more lines are too long
33
special_tokens_map.json
Normal file
33
special_tokens_map.json
Normal file
@@ -0,0 +1,33 @@
|
|||||||
|
{
|
||||||
|
"boi_token": "<start_of_image>",
|
||||||
|
"bos_token": {
|
||||||
|
"content": "<bos>",
|
||||||
|
"lstrip": false,
|
||||||
|
"normalized": false,
|
||||||
|
"rstrip": false,
|
||||||
|
"single_word": false
|
||||||
|
},
|
||||||
|
"eoi_token": "<end_of_image>",
|
||||||
|
"eos_token": {
|
||||||
|
"content": "<eos>",
|
||||||
|
"lstrip": false,
|
||||||
|
"normalized": false,
|
||||||
|
"rstrip": false,
|
||||||
|
"single_word": false
|
||||||
|
},
|
||||||
|
"image_token": "<image_soft_token>",
|
||||||
|
"pad_token": {
|
||||||
|
"content": "<pad>",
|
||||||
|
"lstrip": false,
|
||||||
|
"normalized": false,
|
||||||
|
"rstrip": false,
|
||||||
|
"single_word": false
|
||||||
|
},
|
||||||
|
"unk_token": {
|
||||||
|
"content": "<unk>",
|
||||||
|
"lstrip": false,
|
||||||
|
"normalized": false,
|
||||||
|
"rstrip": false,
|
||||||
|
"single_word": false
|
||||||
|
}
|
||||||
|
}
|
||||||
3
tokenizer.json
Normal file
3
tokenizer.json
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d786405177734910d7a3db625c2826640964a0b4e5cdbbd70620ae3313a01bef
|
||||||
|
size 33384722
|
||||||
3
tokenizer.model
Normal file
3
tokenizer.model
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:1299c11d7cf632ef3b4e11937501358ada021bbdf7c47638d13c0ee982f2e79c
|
||||||
|
size 4689074
|
||||||
51345
tokenizer_config.json
Normal file
51345
tokenizer_config.json
Normal file
File diff suppressed because it is too large
Load Diff
Reference in New Issue
Block a user