初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/Aura-12B-FT-i1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-10-01 22:09:19 +08:00
commit 22e01932ce
27 changed files with 221 additions and 0 deletions

60
.gitattributes vendored Normal file
View File

@@ -0,0 +1,60 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
imatrix.dat filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
Aura-12B-FT.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c5b207df762bd21425107b1fbf84a4a3fe32f17bedc65f59408c9e61650ef02b
size 3221625024

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3adf9f7904f400ce3081a35905ac3c508d1d285d241ffa9e4b95b80e3fc0abe7
size 2999212224

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6d6a0cadf46a0f34a533db134805e49ab7c39a794f8a037dc4edc2c8ca3674ac
size 4435024064

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:824fb441a32c4e8c302feee992704b9de45b6046b6829d862f07f6cc58010181
size 4138473664

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f31a0ff512d3b6fa4bc619ed71b566137612e29d338475cd8cc8211131bccd35
size 3915077824

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:df61b1350a26be61e17f4bccdbf7faa9d9235840001f78fe42ea0e9e0add994a
size 3592313024

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fd886139272f8468025f3e2016e5fc20b7c05a1fbecefb3b161a6a26a98ac73c
size 5722233024

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fcd17d7c50f1725f955d6086f22fe1831b0b2d49dc4bc7ad40839a809dfc9059
size 5562079424

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ef62f8abd3edb9b8065855542ed6838eb629c1c37fea08318ba02c02db6280a4
size 5306489024

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4e68ea3df27f1cd8a24fd1a9b6f0aded6e42411a80379e56cce6fc4383a23d67
size 4945385664

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:22cc103cc677daae9e95d22154919846ec6ab0f0944a31d986b7a9c90e45f4a0
size 7097915584

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8674ac48d7e6f62d0617a98cf96870631ffad699e3358e40fc051f55ff4fe4d8
size 6742710464

3
Aura-12B-FT.i1-Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bc8af326d14b86871a08cf4434a569d06ae31cde8cd50784c6def10cc819f97c
size 4791048384

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dbd882384825ac89a2151d8c2ebc0734cab11603e34270fca3bcdc8fd4d35f9a
size 4493678784

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f0e8077daeae3f91229716ab1961f239fb1a0255c094d14ad5b4467764edf23b
size 6561503424

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dd01a2ed5cfac7413112d7dd954d7bf8b759a8ba58ae72dfdb2322aabd49c12c
size 6083090624

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:30820549ac971354bdd4259f142f025a4c2c5923609f72ca91d182aa18dfd6ee
size 5534226624

3
Aura-12B-FT.i1-Q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b6699a58aea346c55c9403072d59eb4345efc3b0be43f7cf1b1f381b96ad9a13
size 7094638784

3
Aura-12B-FT.i1-Q4_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:18d162b256710f3af8ddf0341c5815c69bceaa46e96f146a8da66381397a9bcd
size 7795218624

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f29df7086cab627508d590e5d16728e51054d83a3a63ad222486c151039069f5
size 7477205184

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:55e351378a47760836723a865357e2ef3f30c602b5f480abaf6967c0b2fb0dc1
size 7120197824

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5e248cbb0795451d8fdde64d594dc4b5166279cd020e0f80dc70b8544df1bf63
size 8727632064

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:686998698b4e02e795844c273693e7eeaada66fa4838e5f4bd913e3d70f4e8f8
size 8518736064

3
Aura-12B-FT.i1-Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fcf80d08236be952392540c4805cc9b92b86a89c56872d104e9e6c4031013311
size 10056210624

86
README.md Normal file
View File

@@ -0,0 +1,86 @@
---
base_model: hardlyworking/Aura-12B-FT
datasets:
- hardlyworking/LighterRPSet
- jeiku/Writing
language:
- en
library_name: transformers
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- axolotl
- generated_from_trainer
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: nicoboss -->
weighted/imatrix quants of https://huggingface.co/hardlyworking/Aura-12B-FT
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Aura-12B-FT-i1-GGUF).***
static quants are available at https://huggingface.co/mradermacher/Aura-12B-FT-GGUF
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ1_S.gguf) | i1-IQ1_S | 3.1 | for the desperate |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ1_M.gguf) | i1-IQ1_M | 3.3 | mostly desperate |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 3.7 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ2_XS.gguf) | i1-IQ2_XS | 4.0 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ2_S.gguf) | i1-IQ2_S | 4.2 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ2_M.gguf) | i1-IQ2_M | 4.5 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q2_K_S.gguf) | i1-Q2_K_S | 4.6 | very low quality |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q2_K.gguf) | i1-Q2_K | 4.9 | IQ3_XXS probably better |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 5.0 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ3_XS.gguf) | i1-IQ3_XS | 5.4 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q3_K_S.gguf) | i1-Q3_K_S | 5.6 | IQ3_XS probably better |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ3_S.gguf) | i1-IQ3_S | 5.7 | beats Q3_K* |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ3_M.gguf) | i1-IQ3_M | 5.8 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q3_K_M.gguf) | i1-Q3_K_M | 6.2 | IQ3_S probably better |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q3_K_L.gguf) | i1-Q3_K_L | 6.7 | IQ3_M probably better |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ4_XS.gguf) | i1-IQ4_XS | 6.8 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q4_0.gguf) | i1-Q4_0 | 7.2 | fast, low quality |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-IQ4_NL.gguf) | i1-IQ4_NL | 7.2 | prefer IQ4_XS |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q4_K_S.gguf) | i1-Q4_K_S | 7.2 | optimal size/speed/quality |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q4_K_M.gguf) | i1-Q4_K_M | 7.6 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q4_1.gguf) | i1-Q4_1 | 7.9 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q5_K_S.gguf) | i1-Q5_K_S | 8.6 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q5_K_M.gguf) | i1-Q5_K_M | 8.8 | |
| [GGUF](https://huggingface.co/mradermacher/Aura-12B-FT-i1-GGUF/resolve/main/Aura-12B-FT.i1-Q6_K.gguf) | i1-Q6_K | 10.2 | practically like static Q6_K |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
<!-- end -->

3
imatrix.dat Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c14520e77b91a9d6019faefb8d5aa732006e00776b9b26b21d06260a766c6c9c
size 7054405