初始化项目,由ModelHub XC社区提供模型
Model: sayhan/gemma-7b-it-GGUF-quantized Source: Original Platform
This commit is contained in:
59
.gitattributes
vendored
Normal file
59
.gitattributes
vendored
Normal file
@@ -0,0 +1,59 @@
|
|||||||
|
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.model filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||||
|
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||||
|
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it-fp16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_L-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q3_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q4_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q5_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q6_K-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
|
gemma-7b-it.Q8_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||||
51
README.md
Normal file
51
README.md
Normal file
@@ -0,0 +1,51 @@
|
|||||||
|
---
|
||||||
|
base_model: google/gemma-7b-it
|
||||||
|
language:
|
||||||
|
- en
|
||||||
|
pipeline_tag: text-generation
|
||||||
|
license: other
|
||||||
|
model_type: gemma
|
||||||
|
library_name: transformers
|
||||||
|
inference: false
|
||||||
|
---
|
||||||
|

|
||||||
|
## Google Gemma 7B Instruct
|
||||||
|
- **Model creator:** [Google](https://huggingface.co/google)
|
||||||
|
- **Original model:** [gemma-7b-it](https://huggingface.co/google/gemma-7b-it)
|
||||||
|
- [**Terms of use**](https://www.kaggle.com/models/google/gemma/license/consent)
|
||||||
|
<!-- description start -->
|
||||||
|
## Description
|
||||||
|
This repo contains GGUF format model files for [Google's Gemma 7B Instruct](https://huggingface.co/google/gemma-7b-it)
|
||||||
|
|
||||||
|
## Original model
|
||||||
|
- **Developed by:** [Google](https://huggingface.co/google)
|
||||||
|
|
||||||
|
### Description
|
||||||
|
Gemma is a family of lightweight, state-of-the-art open models from Google,
|
||||||
|
built from the same research and technology used to create the Gemini models.
|
||||||
|
They are text-to-text, decoder-only large language models, available in English,
|
||||||
|
with open weights, pre-trained variants, and instruction-tuned variants. Gemma
|
||||||
|
models are well-suited for a variety of text generation tasks, including
|
||||||
|
question answering, summarization, and reasoning. Their relatively small size
|
||||||
|
makes it possible to deploy them in environments with limited resources such as
|
||||||
|
a laptop, desktop or your own cloud infrastructure, democratizing access to
|
||||||
|
state of the art AI models and helping foster innovation for everyone.
|
||||||
|
|
||||||
|
## Quantizon types
|
||||||
|
| quantization method | bits | size | description | recommended |
|
||||||
|
|---------------------|------|----------|-----------------------------------------------------|-------------|
|
||||||
|
| Q3_K_S | 3 | 3.68 GB | very small, high quality loss | ❌ |
|
||||||
|
| Q3_K_L | 3 | 4.4 GB | small, substantial quality loss | ❌ |
|
||||||
|
| Q4_0 | 4 | 4.81 GB | legacy; small, very high quality loss | ❌ |
|
||||||
|
| Q4_K_M | 4 | 5.13 GB | medium, balanced quality | ✅ |
|
||||||
|
| Q5_0 | 5 | 5.88 GB | legacy; medium, balanced quality | ❌ |
|
||||||
|
| Q5_K_S | 5 | 5.88 GB | large, low quality loss | ✅ |
|
||||||
|
| Q5_K_M | 5 | 6.04 GB | large, very low quality loss | ✅ |
|
||||||
|
| Q6_K | 6 | 7.01 GB | very large, extremely low quality loss | ❌ |
|
||||||
|
| Q8_0 | 8 | 9.08 GB | very large, extremely low quality loss | ❌ |
|
||||||
|
| FP16 | 16 | 17.1 GB | enormous, negligible quality loss | ❌ |
|
||||||
|
|
||||||
|
## Usage
|
||||||
|
You can use this model with the latest builds of **LM Studio** and **llama.cpp**.
|
||||||
|
If you're new to the world of _large language models_, I recommend starting with **LM Studio**.
|
||||||
|
<!-- description end -->
|
||||||
3
gemma-7b-it-fp16.gguf
Normal file
3
gemma-7b-it-fp16.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:d19e52732bddcb9902347a9c60c117801ad7a3b776b700b9d1649f63f6d80dc0
|
||||||
|
size 17081756544
|
||||||
3
gemma-7b-it.Q3_K_L-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_L-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:9faa5a960635f5967b70b7f316266f7ddccdd2a71496c0c11c4fbf751ad3bec4
|
||||||
|
size 4401867744
|
||||||
3
gemma-7b-it.Q3_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:2a30107cc0408bc9e89fba817929979aed868730f07dc063bcfcd8a273d6a3a7
|
||||||
|
size 4062129120
|
||||||
3
gemma-7b-it.Q3_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:2de33322c8827fcf52c272355eb37208353f37011fa309744ceec05dce8e44e4
|
||||||
|
size 3675204576
|
||||||
3
gemma-7b-it.Q4_0-v2.gguf
Normal file
3
gemma-7b-it.Q4_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:ec234811467d551dc51c398d97ba6d4d6dce55eac210483e940e6e57c97309e2
|
||||||
|
size 4809092064
|
||||||
3
gemma-7b-it.Q4_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q4_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:457449b3e6f41a6d7d774c06a59e518ae9bb329225c415eea47bca414b2e9643
|
||||||
|
size 5127007200
|
||||||
3
gemma-7b-it.Q4_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q4_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:624c5a35bb7e297336e5e2c0868566065b5ce4002c4378a7832790dc2d2ceef5
|
||||||
|
size 4843695072
|
||||||
3
gemma-7b-it.Q5_0-v2.gguf
Normal file
3
gemma-7b-it.Q5_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:4f12cc04ef24077de544af7db3371b9d4c463aec8bb94a44f36564b6745687f0
|
||||||
|
size 5876280288
|
||||||
3
gemma-7b-it.Q5_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q5_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:528611c83f8a40c3009863ae787c2e21d7db9320c96b708702166280730ce971
|
||||||
|
size 6040054752
|
||||||
3
gemma-7b-it.Q5_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q5_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:29acd8103ba6d88b7846a99796fe59eaeeb39b95640e4268e462ac6e434e8f5e
|
||||||
|
size 5876280288
|
||||||
3
gemma-7b-it.Q6_K-v2.gguf
Normal file
3
gemma-7b-it.Q6_K-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:94cbd27f2332c09a265eb3509f05672656827556f98489f902cf941e9b920ce7
|
||||||
|
size 7010167776
|
||||||
3
gemma-7b-it.Q8_0-v2.gguf
Normal file
3
gemma-7b-it.Q8_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
|||||||
|
version https://git-lfs.github.com/spec/v1
|
||||||
|
oid sha256:91f092aa54e2472e66085030edd77d038df72ceaefae7bbf7de1ff3262eb6625
|
||||||
|
size 9077844960
|
||||||
Reference in New Issue
Block a user