commit 6f5c48b4318198167cb282162c6af7bda4f3aa89 Author: ModelHub XC Date: Sat Jul 11 08:10:09 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Experiment28M7_NeuralExperiment26-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..0ae8cbc --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.f16.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Experiment28M7_NeuralExperiment26.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Experiment28M7_NeuralExperiment26.IQ4_XS.gguf b/Experiment28M7_NeuralExperiment26.IQ4_XS.gguf new file mode 100644 index 0000000..19c44af --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a6bbc98ec5f45d6acff2e5d69f50ebb930acfacab3d3d9c2c21927af28e195d9 +size 3944389824 diff --git a/Experiment28M7_NeuralExperiment26.Q2_K.gguf b/Experiment28M7_NeuralExperiment26.Q2_K.gguf new file mode 100644 index 0000000..4f917d1 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:75ad5b945ffbb59bafe01db8fd99cb0a90631019ad4c423a6f2ab900754bfa42 +size 2719243456 diff --git a/Experiment28M7_NeuralExperiment26.Q3_K_L.gguf b/Experiment28M7_NeuralExperiment26.Q3_K_L.gguf new file mode 100644 index 0000000..6446b7e --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:de06243a978a6f78b8cf1cfb16802e8f4a9352eadb6a59f0529f6db13b726212 +size 3822025920 diff --git a/Experiment28M7_NeuralExperiment26.Q3_K_M.gguf b/Experiment28M7_NeuralExperiment26.Q3_K_M.gguf new file mode 100644 index 0000000..7fadcc1 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ac3644a58a82a3bcfaf29c21e63a280ae4965c33f9c07fd761888348a4f24eec +size 3518987456 diff --git a/Experiment28M7_NeuralExperiment26.Q3_K_S.gguf b/Experiment28M7_NeuralExperiment26.Q3_K_S.gguf new file mode 100644 index 0000000..78f0d0c --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:167177c21eb95bd578a0a334fbe282ca70d60c898ec64ababc5abfdbb14e72ac +size 3164568768 diff --git a/Experiment28M7_NeuralExperiment26.Q4_K_M.gguf b/Experiment28M7_NeuralExperiment26.Q4_K_M.gguf new file mode 100644 index 0000000..b69c195 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:34b04f2896e0a2be72ba12f63096148b306a0f77d1ef9139240a75bfc6634ef1 +size 4368440512 diff --git a/Experiment28M7_NeuralExperiment26.Q4_K_S.gguf b/Experiment28M7_NeuralExperiment26.Q4_K_S.gguf new file mode 100644 index 0000000..996a517 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f39744db7e2221fd8023b12457a4619a2e9e6591a552bcc6196563f979140476 +size 4140375232 diff --git a/Experiment28M7_NeuralExperiment26.Q5_K_M.gguf b/Experiment28M7_NeuralExperiment26.Q5_K_M.gguf new file mode 100644 index 0000000..5c8dc98 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cddcf0b51b931ce425ac323fbd981a165dbde39f54a60a3d7a1c4632275b935e +size 5131410624 diff --git a/Experiment28M7_NeuralExperiment26.Q5_K_S.gguf b/Experiment28M7_NeuralExperiment26.Q5_K_S.gguf new file mode 100644 index 0000000..184e712 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6ef7e8de89e03c89369ffc51eeb9b1a9d8572a8a826d6409c4c0c71c1334e6b7 +size 4997717184 diff --git a/Experiment28M7_NeuralExperiment26.Q6_K.gguf b/Experiment28M7_NeuralExperiment26.Q6_K.gguf new file mode 100644 index 0000000..36aaaae --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:20b03b47e0166628f81cda740f82bac3f1a83b02e8249524aa8c32ac8d577386 +size 5942066368 diff --git a/Experiment28M7_NeuralExperiment26.Q8_0.gguf b/Experiment28M7_NeuralExperiment26.Q8_0.gguf new file mode 100644 index 0000000..56f34fd --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c0ede6020de787fc6c9c9d173640f99b5d71f77bbdf26fda6780ec928a501755 +size 7695858880 diff --git a/Experiment28M7_NeuralExperiment26.f16.gguf b/Experiment28M7_NeuralExperiment26.f16.gguf new file mode 100644 index 0000000..3968d19 --- /dev/null +++ b/Experiment28M7_NeuralExperiment26.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3678d0202f40cf7354c2cb9f2d42dac0c7f148cd1d135668996d1e4e2645b519 +size 14484733120 diff --git a/README.md b/README.md new file mode 100644 index 0000000..96c6793 --- /dev/null +++ b/README.md @@ -0,0 +1,70 @@ +--- +base_model: MaziyarPanahi/Experiment28M7_NeuralExperiment26 +language: +- en +library_name: transformers +license: apache-2.0 +model_creator: MaziyarPanahi +model_name: Experiment28M7_NeuralExperiment26 +quantized_by: mradermacher +tags: +- Safetensors +- text-generation-inference +- merge +--- +## About + + + + + + +static quants of https://huggingface.co/MaziyarPanahi/Experiment28M7_NeuralExperiment26 + + +weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion. +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q2_K.gguf) | Q2_K | 2.8 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q3_K_S.gguf) | Q3_K_S | 3.3 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q3_K_M.gguf) | Q3_K_M | 3.6 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q3_K_L.gguf) | Q3_K_L | 3.9 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.IQ4_XS.gguf) | IQ4_XS | 4.0 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q4_K_S.gguf) | Q4_K_S | 4.2 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q4_K_M.gguf) | Q4_K_M | 4.5 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q5_K_S.gguf) | Q5_K_S | 5.1 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q5_K_M.gguf) | Q5_K_M | 5.2 | | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q6_K.gguf) | Q6_K | 6.0 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.Q8_0.gguf) | Q8_0 | 7.8 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Experiment28M7_NeuralExperiment26-GGUF/resolve/main/Experiment28M7_NeuralExperiment26.f16.gguf) | f16 | 14.6 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +