commit a64fbaa14e56280d961825e46f71d80bc1ba0968 Author: ModelHub XC Date: Mon Jun 29 07:58:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Falcon-H1-7B-Base-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..2bc6d13 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.f16.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Falcon-H1-7B-Base.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Falcon-H1-7B-Base.IQ4_XS.gguf b/Falcon-H1-7B-Base.IQ4_XS.gguf new file mode 100644 index 0000000..48f0756 --- /dev/null +++ b/Falcon-H1-7B-Base.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:27b8cd5561bfe75bf562663e6dbc452d5c517737b3408d327897ac5d3794cc11 +size 4190141760 diff --git a/Falcon-H1-7B-Base.Q2_K.gguf b/Falcon-H1-7B-Base.Q2_K.gguf new file mode 100644 index 0000000..45cab86 --- /dev/null +++ b/Falcon-H1-7B-Base.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dbd8eb1f1dca5f07770be9c28f8dc60b1a25e7be69eccd145745a2300e7a44fd +size 2893688640 diff --git a/Falcon-H1-7B-Base.Q3_K_L.gguf b/Falcon-H1-7B-Base.Q3_K_L.gguf new file mode 100644 index 0000000..efa5ca5 --- /dev/null +++ b/Falcon-H1-7B-Base.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:57cd20d56cebb76afcf9eeb5591c6292c8fd7ba098ba9f194671257d8a0e039c +size 3916183104 diff --git a/Falcon-H1-7B-Base.Q3_K_M.gguf b/Falcon-H1-7B-Base.Q3_K_M.gguf new file mode 100644 index 0000000..b0d07bd --- /dev/null +++ b/Falcon-H1-7B-Base.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:498aa0a0506036794a20604347a9d85edcc04000f1c8c37823c73fc38e98e878 +size 3687921216 diff --git a/Falcon-H1-7B-Base.Q3_K_S.gguf b/Falcon-H1-7B-Base.Q3_K_S.gguf new file mode 100644 index 0000000..32d4431 --- /dev/null +++ b/Falcon-H1-7B-Base.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b00d3621fbcab17db1f3151fe5c86fd48a0e5dc925f8593d8cd67bf3959d5d9e +size 3425523264 diff --git a/Falcon-H1-7B-Base.Q4_K_M.gguf b/Falcon-H1-7B-Base.Q4_K_M.gguf new file mode 100644 index 0000000..7ccf418 --- /dev/null +++ b/Falcon-H1-7B-Base.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3f7fab37b2836e7f71e6e0fa2ad850d809c6115f0a2f0d6e4ef36de3c03ca8ba +size 4598339904 diff --git a/Falcon-H1-7B-Base.Q4_K_S.gguf b/Falcon-H1-7B-Base.Q4_K_S.gguf new file mode 100644 index 0000000..9a8fff7 --- /dev/null +++ b/Falcon-H1-7B-Base.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:68f91d8cd7c61f76cc9ab731e7d5c4e7706cbf580dab1420a65e2967789bd8d7 +size 4403759424 diff --git a/Falcon-H1-7B-Base.Q5_K_M.gguf b/Falcon-H1-7B-Base.Q5_K_M.gguf new file mode 100644 index 0000000..c9d74af --- /dev/null +++ b/Falcon-H1-7B-Base.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d3b82a480ce52767bbb98c42e1e4bda8298a39ae1444a0b1a6a0388cfda0a223 +size 5390485824 diff --git a/Falcon-H1-7B-Base.Q5_K_S.gguf b/Falcon-H1-7B-Base.Q5_K_S.gguf new file mode 100644 index 0000000..61d6f9b --- /dev/null +++ b/Falcon-H1-7B-Base.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:80f0c3228a37400322846be4c8e266a29e7843d1557658a2a79a5a7194d9e976 +size 5277890880 diff --git a/Falcon-H1-7B-Base.Q6_K.gguf b/Falcon-H1-7B-Base.Q6_K.gguf new file mode 100644 index 0000000..9be1afc --- /dev/null +++ b/Falcon-H1-7B-Base.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4166b7b63d6cb1d4a587b39be7246918aa1fc85dc6a67e0a4baff9dad9965f62 +size 6232140864 diff --git a/Falcon-H1-7B-Base.Q8_0.gguf b/Falcon-H1-7B-Base.Q8_0.gguf new file mode 100644 index 0000000..9c30ef7 --- /dev/null +++ b/Falcon-H1-7B-Base.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:39a3b468ab48f38c80504c5a3fef0a5676500a2b8de74f37762e4663df574bb2 +size 8068999488 diff --git a/Falcon-H1-7B-Base.f16.gguf b/Falcon-H1-7B-Base.f16.gguf new file mode 100644 index 0000000..eb18fab --- /dev/null +++ b/Falcon-H1-7B-Base.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4c99f67c2343d3e63afd5b2ac820586e18dddbe1cd8f33f05214496c22fd0a3b +size 15179419968 diff --git a/README.md b/README.md new file mode 100644 index 0000000..2cb0f6b --- /dev/null +++ b/README.md @@ -0,0 +1,90 @@ +--- +base_model: tiiuae/Falcon-H1-7B-Base +language: +- ar +- cs +- de +- en +- es +- fr +- hi +- it +- ja +- ko +- nl +- pl +- pt +- ro +- ru +- sv +- ur +- zh +library_name: transformers +license: other +license_link: https://falconllm.tii.ae/falcon-terms-and-conditions.html +license_name: falcon-llm-license +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +tags: +- falcon-h1 +--- +## About + + + + + + +static quants of https://huggingface.co/tiiuae/Falcon-H1-7B-Base + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Falcon-H1-7B-Base-GGUF).*** + +weighted/imatrix quants are available at https://huggingface.co/mradermacher/Falcon-H1-7B-Base-i1-GGUF +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q2_K.gguf) | Q2_K | 3.0 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q3_K_S.gguf) | Q3_K_S | 3.5 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q3_K_M.gguf) | Q3_K_M | 3.8 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q3_K_L.gguf) | Q3_K_L | 4.0 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.IQ4_XS.gguf) | IQ4_XS | 4.3 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q4_K_S.gguf) | Q4_K_S | 4.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q4_K_M.gguf) | Q4_K_M | 4.7 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q5_K_S.gguf) | Q5_K_S | 5.4 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q5_K_M.gguf) | Q5_K_M | 5.5 | | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q6_K.gguf) | Q6_K | 6.3 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.Q8_0.gguf) | Q8_0 | 8.2 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Falcon-H1-7B-Base-GGUF/resolve/main/Falcon-H1-7B-Base.f16.gguf) | f16 | 15.3 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +