commit c2e316d000cce02416ddef1003b7676c147fa089 Author: ModelHub XC Date: Sat Jul 4 07:34:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Clara-24B-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..8b23229 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,46 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Clara-24B.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Clara-24B.IQ4_XS.gguf b/Clara-24B.IQ4_XS.gguf new file mode 100644 index 0000000..39c3f68 --- /dev/null +++ b/Clara-24B.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a997e3fb3d51ac5fbf706e317fcbe07424889c31024be08a5e9d4bbb8ef14e50 +size 12889988704 diff --git a/Clara-24B.Q2_K.gguf b/Clara-24B.Q2_K.gguf new file mode 100644 index 0000000..bf3edf9 --- /dev/null +++ b/Clara-24B.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b508595847161e41ba1a37baa818514daf4ef6c8f121bd454d70411cb8689bfe +size 8890326624 diff --git a/Clara-24B.Q3_K_L.gguf b/Clara-24B.Q3_K_L.gguf new file mode 100644 index 0000000..3fec61e --- /dev/null +++ b/Clara-24B.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:076cc787f41a614b52e659da29b61b38a7c2312582c200f055888a44bfb456d0 +size 12400762464 diff --git a/Clara-24B.Q3_K_M.gguf b/Clara-24B.Q3_K_M.gguf new file mode 100644 index 0000000..277f7bc --- /dev/null +++ b/Clara-24B.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:23a4dd12d58c7702ee98b436fa8ee979c606da7a84dc52005f9a04faf6da2d3a +size 11474083424 diff --git a/Clara-24B.Q3_K_S.gguf b/Clara-24B.Q3_K_S.gguf new file mode 100644 index 0000000..940d933 --- /dev/null +++ b/Clara-24B.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7aca157faab8836cd992c4b77bcdd3d461c0563c304e9f302e6570c2d6b9c56e +size 10400276064 diff --git a/Clara-24B.Q4_K_M.gguf b/Clara-24B.Q4_K_M.gguf new file mode 100644 index 0000000..1e69e30 --- /dev/null +++ b/Clara-24B.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fe1afdfd674988d164d4889dba414fbf0433d519b023c8f0db7d10ee5799200d +size 14333910624 diff --git a/Clara-24B.Q4_K_S.gguf b/Clara-24B.Q4_K_S.gguf new file mode 100644 index 0000000..012a06f --- /dev/null +++ b/Clara-24B.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0e87ab5df778079c2cd83af41ad12dd7565a7c35cca685d2d706ef8fd21ae360 +size 13549280864 diff --git a/Clara-24B.Q5_K_M.gguf b/Clara-24B.Q5_K_M.gguf new file mode 100644 index 0000000..dcde210 --- /dev/null +++ b/Clara-24B.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bced0bcacfb84b7cad2d88e82691417793c85a63c64266a98be0beaa6370a2d3 +size 16763985504 diff --git a/Clara-24B.Q5_K_S.gguf b/Clara-24B.Q5_K_S.gguf new file mode 100644 index 0000000..efd2e08 --- /dev/null +++ b/Clara-24B.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a76186230518c3f03d63e29b8a35588bc42eadf8c3ab07eb0216841596deb1ac +size 16304414304 diff --git a/Clara-24B.Q6_K.gguf b/Clara-24B.Q6_K.gguf new file mode 100644 index 0000000..f1df852 --- /dev/null +++ b/Clara-24B.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:abe1afc72dc055c429c43860c8281577e21ba5e9d160ed7a828cdf8ea9e31a5e +size 19345940064 diff --git a/Clara-24B.Q8_0.gguf b/Clara-24B.Q8_0.gguf new file mode 100644 index 0000000..bdfe1f7 --- /dev/null +++ b/Clara-24B.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c0214fc811c04264ee831e93c164938e8894dbb0d11e007ef1acf42dc25b7d5d +size 25054781024 diff --git a/README.md b/README.md new file mode 100644 index 0000000..5bf1fbe --- /dev/null +++ b/README.md @@ -0,0 +1,77 @@ +--- +base_model: ayan4m1/Clara-24B +datasets: +- mlfoundations-dev/oh-dcft-v3.1-claude-3-5-sonnet-20241022 +- Gryphe/Sonnet3.5-SlimOrcaDedupCleaned +- nothingiisreal/Claude-3-Opus-Instruct-15K +language: +- en +library_name: transformers +license: apache-2.0 +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +tags: +- text-generation-inference +- transformers +- unsloth +- mistral3 +--- +## About + + + + + + +static quants of https://huggingface.co/ayan4m1/Clara-24B + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Clara-24B-GGUF).*** + +weighted/imatrix quants are available at https://huggingface.co/mradermacher/Clara-24B-i1-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q2_K.gguf) | Q2_K | 9.0 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q3_K_S.gguf) | Q3_K_S | 10.5 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q3_K_M.gguf) | Q3_K_M | 11.6 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q3_K_L.gguf) | Q3_K_L | 12.5 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.IQ4_XS.gguf) | IQ4_XS | 13.0 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q4_K_S.gguf) | Q4_K_S | 13.6 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q4_K_M.gguf) | Q4_K_M | 14.4 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q5_K_S.gguf) | Q5_K_S | 16.4 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q5_K_M.gguf) | Q5_K_M | 16.9 | | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q6_K.gguf) | Q6_K | 19.4 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Clara-24B-GGUF/resolve/main/Clara-24B.Q8_0.gguf) | Q8_0 | 25.2 | fast, best quality | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +