commit f69df1b435b5dfe39feea7547397e1f928537cce Author: ModelHub XC Date: Thu Jun 11 09:10:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Aura-8B-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..9132e58 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,48 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Aura-8B.f16.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Aura-8B.Q4_0_4_4.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Aura-8B.IQ4_XS.gguf b/Aura-8B.IQ4_XS.gguf new file mode 100644 index 0000000..f42f138 --- /dev/null +++ b/Aura-8B.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bf4e7e8baf9d8f5a7a32cfe07423930c250fa522f73ac8f48e0f7c57ead56b82 +size 4484365952 diff --git a/Aura-8B.Q2_K.gguf b/Aura-8B.Q2_K.gguf new file mode 100644 index 0000000..6c28fb8 --- /dev/null +++ b/Aura-8B.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:760b85704034fadebcda1948b31d2c6a5fc3636974bca80a967a074fadd592af +size 3179134592 diff --git a/Aura-8B.Q3_K_L.gguf b/Aura-8B.Q3_K_L.gguf new file mode 100644 index 0000000..61149e9 --- /dev/null +++ b/Aura-8B.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:32d4412d1a6b2291163eea8ee68ee051a2831f58f4fab7edaab0ec634890a9fe +size 4321959552 diff --git a/Aura-8B.Q3_K_M.gguf b/Aura-8B.Q3_K_M.gguf new file mode 100644 index 0000000..a586c27 --- /dev/null +++ b/Aura-8B.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5f3ddf4f2dab040019dca5e9fbdd7bdd7f4cbd13b61c5a7b18a32a5b9593bf30 +size 4018921088 diff --git a/Aura-8B.Q3_K_S.gguf b/Aura-8B.Q3_K_S.gguf new file mode 100644 index 0000000..6a5375d --- /dev/null +++ b/Aura-8B.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4dd213e8ad77361c02ce73f45f81c21a01a961ada6ac2f712789b776cceec004 +size 3664502400 diff --git a/Aura-8B.Q4_0_4_4.gguf b/Aura-8B.Q4_0_4_4.gguf new file mode 100644 index 0000000..5470b44 --- /dev/null +++ b/Aura-8B.Q4_0_4_4.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:83b6f1fadf8e7d94389d0d207897ed68b600d4ab21e763055fd3a57b40138095 +size 4661214848 diff --git a/Aura-8B.Q4_K_M.gguf b/Aura-8B.Q4_K_M.gguf new file mode 100644 index 0000000..9ea7657 --- /dev/null +++ b/Aura-8B.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cde75debd515e6a601ad49d2525ba0a2c34f7e1af27474452b60fe68bd3b0a4d +size 4920737408 diff --git a/Aura-8B.Q4_K_S.gguf b/Aura-8B.Q4_K_S.gguf new file mode 100644 index 0000000..b472e7a --- /dev/null +++ b/Aura-8B.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d419cd566a7fc8379877bb14a893008853253dbf25ec58bc0bff97f45fad11ae +size 4692672128 diff --git a/Aura-8B.Q5_K_M.gguf b/Aura-8B.Q5_K_M.gguf new file mode 100644 index 0000000..7839616 --- /dev/null +++ b/Aura-8B.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dde2a51942129081d6e9a7415d5ab6323884f21be7742e4cd54e150339ab7c11 +size 5732990592 diff --git a/Aura-8B.Q5_K_S.gguf b/Aura-8B.Q5_K_S.gguf new file mode 100644 index 0000000..64e53ef --- /dev/null +++ b/Aura-8B.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5616d1e8180cc252a0d6b0e20f4801b5973d4b3402e283efe681dde65347b1be +size 5599297152 diff --git a/Aura-8B.Q6_K.gguf b/Aura-8B.Q6_K.gguf new file mode 100644 index 0000000..b1521e2 --- /dev/null +++ b/Aura-8B.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:90b912e58737387c55b16a799daf8211e51a045bf80642504e6a3f14aa07f4ed +size 6596009600 diff --git a/Aura-8B.Q8_0.gguf b/Aura-8B.Q8_0.gguf new file mode 100644 index 0000000..a46af24 --- /dev/null +++ b/Aura-8B.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5ecf340ae86edc8eab8efce42eb5a07df685bb86a562b3b8454f712ab6ee21cd +size 8540774016 diff --git a/Aura-8B.f16.gguf b/Aura-8B.f16.gguf new file mode 100644 index 0000000..1743c32 --- /dev/null +++ b/Aura-8B.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3c0e0c6048e6b2eb09409f1617699757f3373f6d1165cec56dd8f3fd8721ef5a +size 16068894336 diff --git a/README.md b/README.md new file mode 100644 index 0000000..4f001a9 --- /dev/null +++ b/README.md @@ -0,0 +1,75 @@ +--- +base_model: AuraIndustries/Aura-8B +datasets: +- FourOhFour/RP_Phase +- Nitral-AI/Cybersecurity-ShareGPT +- Nitral-AI/Medical_Instruct-ShareGPT +- Nitral-AI/Olympiad_Math-ShareGPT +- NewEden/Claude-Instruct-5K +- lodrick-the-lafted/kalo-opus-instruct-3k-filtered +- Nitral-AI/Creative_Writing-ShareGPT +- jeiku/Writing +- anthracite-core/full-opus-chosen-hermes-rejected-kto-v1 +language: +- en +library_name: transformers +license: apache-2.0 +quantized_by: mradermacher +--- +## About + + + + + + +static quants of https://huggingface.co/AuraIndustries/Aura-8B + + +weighted/imatrix quants are available at https://huggingface.co/mradermacher/Aura-8B-i1-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q2_K.gguf) | Q2_K | 3.3 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q3_K_S.gguf) | Q3_K_S | 3.8 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q3_K_M.gguf) | Q3_K_M | 4.1 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q3_K_L.gguf) | Q3_K_L | 4.4 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.IQ4_XS.gguf) | IQ4_XS | 4.6 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q4_0_4_4.gguf) | Q4_0_4_4 | 4.8 | fast on arm, low quality | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q4_K_S.gguf) | Q4_K_S | 4.8 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q4_K_M.gguf) | Q4_K_M | 5.0 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q5_K_S.gguf) | Q5_K_S | 5.7 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q5_K_M.gguf) | Q5_K_M | 5.8 | | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q6_K.gguf) | Q6_K | 6.7 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.Q8_0.gguf) | Q8_0 | 8.6 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Aura-8B-GGUF/resolve/main/Aura-8B.f16.gguf) | f16 | 16.2 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to. + +