From 13db592252f0152c39d1c8302b3139203ddc2281 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Wed, 8 Jul 2026 06:45:09 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: brittlewis12/gemma-7b-it-GGUF Source: Original Platform --- .gitattributes | 46 ++++++++++++++++++ README.md | 102 ++++++++++++++++++++++++++++++++++++++++ gemma-7b-it.Q2_K.gguf | 3 ++ gemma-7b-it.Q3_K_L.gguf | 3 ++ gemma-7b-it.Q3_K_M.gguf | 3 ++ gemma-7b-it.Q3_K_S.gguf | 3 ++ gemma-7b-it.Q4_K_M.gguf | 3 ++ gemma-7b-it.Q4_K_S.gguf | 3 ++ gemma-7b-it.Q5_K_M.gguf | 3 ++ gemma-7b-it.Q5_K_S.gguf | 3 ++ gemma-7b-it.Q6_K.gguf | 3 ++ gemma-7b-it.Q8_0.gguf | 3 ++ gemma-7b-it.fp16.gguf | 3 ++ 13 files changed, 181 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 gemma-7b-it.Q2_K.gguf create mode 100644 gemma-7b-it.Q3_K_L.gguf create mode 100644 gemma-7b-it.Q3_K_M.gguf create mode 100644 gemma-7b-it.Q3_K_S.gguf create mode 100644 gemma-7b-it.Q4_K_M.gguf create mode 100644 gemma-7b-it.Q4_K_S.gguf create mode 100644 gemma-7b-it.Q5_K_M.gguf create mode 100644 gemma-7b-it.Q5_K_S.gguf create mode 100644 gemma-7b-it.Q6_K.gguf create mode 100644 gemma-7b-it.Q8_0.gguf create mode 100644 gemma-7b-it.fp16.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..388bc1c --- /dev/null +++ b/.gitattributes @@ -0,0 +1,46 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +gemma-7b-it.fp16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..b89d222 --- /dev/null +++ b/README.md @@ -0,0 +1,102 @@ +--- +base_model: google/gemma-7b-it +inference: false +language: + - en +model_creator: google +model_name: gemma-7b-it +model_type: gemma +pipeline_tag: text-generation +license: other +license_name: gemma-terms-of-use +license_link: https://ai.google.dev/gemma/terms +quantized_by: brittlewis12 +--- + +# Gemma 7B Instruct GGUF + +**Original model**: [gemma-7b-it](https://huggingface.co/google/gemma-7b-it) + +**Model creator**: [google](https://huggingface.co/google) + +This repo contains GGUF format model files for Google’s Gemma-7B-it. + +> Gemma is a family of lightweight, state-of-the-art open models from Google, +> built from the same research and technology used to create the Gemini models. +> They are text-to-text, decoder-only large language models, available in English, +> with open weights, pre-trained variants, and instruction-tuned variants. Gemma +> models are well-suited for a variety of text generation tasks, including +> question answering, summarization, and reasoning. Their relatively small size +> makes it possible to deploy them in environments with limited resources such as +> a laptop, desktop or your own cloud infrastructure, democratizing access to +> state of the art AI models and helping foster innovation for everyone. + +Learn more on Google’s [Model page](https://ai.google.dev/gemma/docs). + +### What is GGUF? + +GGUF is a file format for representing AI models. It is the third version of the format, introduced by the llama.cpp team on August 21st 2023. It is a replacement for GGML, which is no longer supported by llama.cpp. +Converted using llama.cpp build 2226 (revision [eccd7a2](https://github.com/ggerganov/llama.cpp/commit/eccd7a26ddbff19e4b8805648f5f14c501957859)) + +### Prompt template: Gemma Instruct + +``` +user +{{prompt}} +model + +``` + +--- + +## Download & run with [cnvrs](https://twitter.com/cnvrsai) on iPhone, iPad, and Mac! + +![cnvrs.ai](https://pbs.twimg.com/profile_images/1744049151241797632/0mIP-P9e_400x400.jpg) + +[cnvrs](https://testflight.apple.com/join/sFWReS7K) is the best app for private, local AI on your device: +- create & save **Characters** with custom system prompts & temperature settings +- download and experiment with any **GGUF model** you can [find on HuggingFace](https://huggingface.co/models?library=gguf)! +- make it your own with custom **Theme colors** +- powered by Metal ⚡️ & [Llama.cpp](https://github.com/ggerganov/llama.cpp), with **haptics** during response streaming! +- **try it out** yourself today, on [Testflight](https://testflight.apple.com/join/sFWReS7K)! +- follow [cnvrs on twitter](https://twitter.com/cnvrsai) to stay up to date + +--- + +## Original Model Evaluation + +| Benchmark | Metric | 2B Params | 7B Params | +| ------------------------------ | ------------- | ----------- | --------- | +| [MMLU](https://arxiv.org/abs/2009.03300) | 5-shot, top-1 | 42.3 | 64.3 | +| [HellaSwag](https://arxiv.org/abs/1905.07830) | 0-shot |71.4 | 81.2 | +| [PIQA](https://arxiv.org/abs/1911.11641) | 0-shot | 77.3 | 81.2 | +| [SocialIQA](https://arxiv.org/abs/1904.09728) | 0-shot | 59.7 | 51.8 | +| [BooIQ](https://arxiv.org/abs/1905.10044) | 0-shot | 69.4 | 83.2 | +| [WinoGrande](https://arxiv.org/abs/1907.10641) | partial score | 65.4 | 72.3 | +| [CommonsenseQA](https://arxiv.org/abs/1811.00937) | 7-shot | 65.3 | 71.3 | +| [OpenBookQA](https://arxiv.org/abs/1809.02789) | | 47.8 | 52.8 | +| [ARC-e](https://arxiv.org/abs/1911.01547) | | 73.2 | 81.5 | +| [ARC-c](https://arxiv.org/abs/1911.01547) | | 42.1 | 53.2 | +| [TriviaQA](https://arxiv.org/abs/1705.03551) | 5-shot | 53.2 | 63.4 | +| [Natural Questions](https://github.com/google-research-datasets/natural-questions) | 5-shot | - | 23 | +| [HumanEval](https://arxiv.org/abs/2107.03374) | pass@1 | 22.0 | 32.3 | +| [MBPP](https://arxiv.org/abs/2108.07732) | 3-shot | 29.2 | 44.4 | +| [GSM8K](https://arxiv.org/abs/2110.14168) | maj@1 | 17.7 | 46.4 | +| [MATH](https://arxiv.org/abs/2108.07732) | 4-shot | 11.8 | 24.3 | +| [AGIEval](https://arxiv.org/abs/2304.06364) | | 24.2 | 41.7 | +| [BIG-Bench](https://arxiv.org/abs/2206.04615) | | 35.2 | 55.1 | +| **Average** | | **54.0** | **56.4** | + + +| Benchmark | Metric | 2B Params | 7B Params | +| ------------------------------ | ------------- | ----------- | --------- | +| [RealToxicity](https://arxiv.org/abs/2009.11462) | average | 6.86 | 7.90 | +| [BOLD](https://arxiv.org/abs/2101.11718) | | 45.57 | 49.08 | +| [CrowS-Pairs](https://aclanthology.org/2020.emnlp-main.154/) | top-1 | 45.82 | 51.33 | +| [BBQ Ambig](https://arxiv.org/abs/2110.08193v2) | 1-shot, top-1 | 62.58 | 92.54 | +| [BBQ Disambig](https://arxiv.org/abs/2110.08193v2) | top-1 | 54.62 | 71.99 | +| [Winogender](https://arxiv.org/abs/1804.09301) | top-1 | 51.25 | 54.17 | +| [TruthfulQA](https://arxiv.org/abs/2109.07958) | | 44.84 | 31.81 | +| [Winobias 1_2](https://arxiv.org/abs/1804.06876) | | 56.12 | 59.09 | +| [Winobias 2_2](https://arxiv.org/abs/1804.06876) | | 91.10 | 92.23 | +| [Toxigen](https://arxiv.org/abs/2203.09509) | | 29.77 | 39.59 | \ No newline at end of file diff --git a/gemma-7b-it.Q2_K.gguf b/gemma-7b-it.Q2_K.gguf new file mode 100644 index 0000000..ad7fb8d --- /dev/null +++ b/gemma-7b-it.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7792c0b8b605f10e9c044d6f4a1920eec2dfc80dd43902f78da0e39a137841a5 +size 3481447392 diff --git a/gemma-7b-it.Q3_K_L.gguf b/gemma-7b-it.Q3_K_L.gguf new file mode 100644 index 0000000..db42b41 --- /dev/null +++ b/gemma-7b-it.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c5e35cf677513d09dbcdf29a47bcdaf63ed778bacb9affc4b2b8c838050d0291 +size 4709067744 diff --git a/gemma-7b-it.Q3_K_M.gguf b/gemma-7b-it.Q3_K_M.gguf new file mode 100644 index 0000000..2cc61e6 --- /dev/null +++ b/gemma-7b-it.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f1b06f617512cec77adc6b7b367c4f8f4fba7139d84314861047bc22370366dd +size 4369329120 diff --git a/gemma-7b-it.Q3_K_S.gguf b/gemma-7b-it.Q3_K_S.gguf new file mode 100644 index 0000000..6623647 --- /dev/null +++ b/gemma-7b-it.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4959545756be532452a78d96fc5d032504b7316a05dc451880463ef28267ca8e +size 3982404576 diff --git a/gemma-7b-it.Q4_K_M.gguf b/gemma-7b-it.Q4_K_M.gguf new file mode 100644 index 0000000..408c27e --- /dev/null +++ b/gemma-7b-it.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:24773891213bdc78b8797c010d3de86ad6e34731c13d6cfe808bcaf8acecd58d +size 5329759200 diff --git a/gemma-7b-it.Q4_K_S.gguf b/gemma-7b-it.Q4_K_S.gguf new file mode 100644 index 0000000..99bddac --- /dev/null +++ b/gemma-7b-it.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6cf3beabf2c5fab581f4c362b3cccf00d4a9031ed5519333e16f5075e4792056 +size 5046447072 diff --git a/gemma-7b-it.Q5_K_M.gguf b/gemma-7b-it.Q5_K_M.gguf new file mode 100644 index 0000000..3be96ff --- /dev/null +++ b/gemma-7b-it.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8489241099947489479e3e3a95d063a69dd6e40c757e095bbc539487b15d3f40 +size 6144502752 diff --git a/gemma-7b-it.Q5_K_S.gguf b/gemma-7b-it.Q5_K_S.gguf new file mode 100644 index 0000000..6a587b1 --- /dev/null +++ b/gemma-7b-it.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:56e42bda0b9afb2c139180787fc8d90a9efb3143d2be8310087e5c8659785d98 +size 5980728288 diff --git a/gemma-7b-it.Q6_K.gguf b/gemma-7b-it.Q6_K.gguf new file mode 100644 index 0000000..3773250 --- /dev/null +++ b/gemma-7b-it.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c36fc8ce87556e97b1dfff2eb212c5687188d65baa06dd9c99bc0b6d908e8ab1 +size 7010167776 diff --git a/gemma-7b-it.Q8_0.gguf b/gemma-7b-it.Q8_0.gguf new file mode 100644 index 0000000..b5e78e6 --- /dev/null +++ b/gemma-7b-it.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4f2ed613525bebca13e6801e9b6e3366daf5130ad2a645a5873bed7ab22bef62 +size 9077844960 diff --git a/gemma-7b-it.fp16.gguf b/gemma-7b-it.fp16.gguf new file mode 100644 index 0000000..0167c2f --- /dev/null +++ b/gemma-7b-it.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d915da6969d46fcdf6c3961f0d1c68632a36876051e1e389d18ffb4b6baa43e9 +size 17081756608