初始化项目,由ModelHub XC社区提供模型

Model: Lewdiculous/Eris_Remix_7B-GGUF-IQ-Imatrix
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-21 21:31:10 +08:00
commit 32c2161071
16 changed files with 174 additions and 0 deletions

49
.gitattributes vendored Normal file
View File

@@ -0,0 +1,49 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q8_0-imat.gguf filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q5_K_S-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q6_K-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q4_K_S-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q5_K_M-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ4_XS-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-Q4_K_M-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ3_XS-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ3_XXS-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ4_NL-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ3_M-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-IQ3_S-imat.gguf filter=lfs diff=lfs merge=lfs -text
Eris_Remix_7B-F16.gguf filter=lfs diff=lfs merge=lfs -text

3
Eris_Remix_7B-F16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:447e3605cf9d01b082b3e366be73208b61f741624ea49cefe508318e6cdd0519
size 14484731584

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7a2fa424332eea12ebeba82fc3ed7ce0d22aee3b0e3dd70e335858e2564abd54
size 3284891360

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f7330ba8ae7b97fe924d3dd84cff234bb18aaa33091d56c7ca538e49d2942486
size 3182393056

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dbb0856638309b75b991cbe81e6dd484c13c6c237d2d851c44a99b55e7be6a38
size 3000989408

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f8db6b487d58a49780b01a7a93cf883b723f3167efc0668e95323a73c6a0d0ec
size 2827343584

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:efa43ed8fd916cba3b2e6f0ba4b11bcef7a830502e3316c9d1b5b2e9cef9cf46
size 4125693664

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6f53268147cb4d9247c08a39033f913a172f819748b9447aa7c923c8002ae32d
size 3907688160

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c33568561c8d2516ba3bff4e28c2c9ae7fd01cd7b5cfdc0d461f21df3f40dc32
size 4368439008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7cb5341a086e58c22cbeb718e85c0340902be9d13af74c33fb4112a4463366d9
size 4140373728

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:54b1164cf1ce0d58292d659c874b9a76643b4614f6b3428f131c92f22c62a155
size 5131409120

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2893a4f90f3326b9e8b871fd7bde2d3fce606710a75f50d8966c7a215aa594c7
size 4997715680

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b8bb03adc44ea1164e4f542402293d891342c810547b55ab3a1dbc41dbc5eb69
size 5942064864

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:32478c6f71c708483befcd9df49d68cd88801dfd68175625a1d140125f73f868
size 7695857376

83
README.md Normal file
View File

@@ -0,0 +1,83 @@
---
library_name: transformers
tags:
- mistral
- quantized
- text-generation-inference
- roleplay
# - rp
# - uncensored
pipeline_tag: text-generation
inference: false
# language:
# - en
# FILL THE INFORMATION:
# Reference: ChaoticNeutrals/Eris_Remix_7B
# Author: ChaoticNeutrals
# Model: Eris_Remix_7B
# Llama.cpp version: b2343
---
```python
quantization_options = [
"Q4_K_M", "Q4_K_S", "IQ4_NL", "IQ4_XS", "Q5_K_M",
"Q5_K_S", "Q6_K", "Q8_0", "IQ3_M", "IQ3_S", "IQ3_XS", "IQ3_XXS"
]
```
## GGUF-Imatrix quantizations for [ChaoticNeutrals/Eris_Remix_7B](https://huggingface.co/ChaoticNeutrals/Eris_Remix_7B/).
All credits belong to the author.
If you liked these, check out the work with [FantasiaFoundry's GGUF-IQ-Imatrix-Quantization-Script](https://huggingface.co/FantasiaFoundry/GGUF-Quantization-Script).
## What does "Imatrix" mean?
It stands for **Importance Matrix**, a technique used to improve the quality of quantized models. <br>
[[1]](https://github.com/ggerganov/llama.cpp/discussions/5006/) <br>
The **Imatrix** is calculated based on calibration data, and it helps determine the importance of different model activations during the quantization process. The idea is to preserve the most important information during quantization, which can help reduce the loss of model performance and lead to better quality preservation, especially when the calibration data is diverse. <br>
[[2]](https://github.com/ggerganov/llama.cpp/discussions/5263#discussioncomment-8395384/)
For --imatrix data, included `imatrix.dat` was used.
Using [llama.cpp-b2343](https://github.com/ggerganov/llama.cpp/releases/tag/b2343/):
```
Base⇢ GGUF(F16)⇢ Imatrix-Data(F16)⇢ GGUF(Imatrix-Quants)
```
The new **IQ3_S** quant-option has shown to be better than the old Q3_K_S, so I added that instead of the later. Only supported in `koboldcpp-1.59.1` or higher.
If you want any specific quantization to be added, feel free to ask.
<!-- ## Model image: -->
## Original model information:
![image/png](https://cdn-uploads.huggingface.co/production/uploads/642265bc01c62c1e4102dc36/YAcs7XqxH3wAYPXjt2vrS.png)
# Remix
### Configuration
The following YAML configuration was used to produce this model:
```yaml
slices:
- sources:
- model: SpecialEdition
layer_range: [0, 32]
- model: Remix
layer_range: [0, 32]
merge_method: slerp
base_model: SpecialEdition
parameters:
t:
- filter: self_attn
value: [0, 0.5, 0.3, 0.7, 1]
- filter: mlp
value: [1, 0.5, 0.7, 0.3, 0]
- value: 0.5
dtype: bfloat16
```

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e353d13131a45b64de87bd31829de9fb2b3c8552ea5d26d8395da2038fd8bc4e
size 4988126