初始化项目,由ModelHub XC社区提供模型
Model: sayhan/gemma-7b-GGUF-quantized Source: Original Platform
This commit is contained in:
60
.gitattributes
vendored
Normal file
60
.gitattributes
vendored
Normal file
@@ -0,0 +1,60 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-fp16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q2_K-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_L-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q3_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q4_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q5_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q6_K-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b.Q8_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
53
README.md
Normal file
53
README.md
Normal file
@@ -0,0 +1,53 @@
|
||||
---
|
||||
base_model: google/gemma-7b
|
||||
language:
|
||||
- en
|
||||
pipeline_tag: text-generation
|
||||
license: other
|
||||
model_type: gemma
|
||||
library_name: transformers
|
||||
inference: false
|
||||
---
|
||||

|
||||
## Google Gemma 7B
|
||||
- **Model creator:** [Google](https://huggingface.co/google)
|
||||
- **Original model:** [gemma-7b-it](https://huggingface.co/google/gemma-7b)
|
||||
- [**Terms of use**](https://www.kaggle.com/models/google/gemma/license/consent)
|
||||
<!-- description start -->
|
||||
## Description
|
||||
This repo contains GGUF format model files for [Google's Gemma 7B](https://huggingface.co/google/gemma-7b)
|
||||
|
||||
## Original model
|
||||
- **Developed by:** [Google](https://huggingface.co/google)
|
||||
|
||||
### Description
|
||||
Gemma is a family of lightweight, state-of-the-art open models from Google,
|
||||
built from the same research and technology used to create the Gemini models.
|
||||
They are text-to-text, decoder-only large language models, available in English,
|
||||
with open weights, pre-trained variants, and instruction-tuned variants. Gemma
|
||||
models are well-suited for a variety of text generation tasks, including
|
||||
question answering, summarization, and reasoning. Their relatively small size
|
||||
makes it possible to deploy them in environments with limited resources such as
|
||||
a laptop, desktop or your own cloud infrastructure, democratizing access to
|
||||
state of the art AI models and helping foster innovation for everyone.
|
||||
|
||||
## Quantizon types
|
||||
| quantization method | bits | size | description | recommended |
|
||||
|---------------------|------|----------|-----------------------------------------------------|-------------|
|
||||
| Q2_K | 2 | 3.09 | very small, very high quality loss | ❌ |
|
||||
| Q3_K_S | 3 | 3.68 GB | very small, high quality loss | ❌ |
|
||||
| Q3_K_L | 3 | 4.4 GB | small, substantial quality loss | ❌ |
|
||||
| Q4_0 | 4 | 4.81 GB | legacy; small, very high quality loss | ❌ |
|
||||
| Q4_K_S | 4 | 4.84 GB | medium, balanced quality | ✅ |
|
||||
| Q4_K_M | 4 | 5.13 GB | medium, balanced quality | ✅ |
|
||||
| Q5_0 | 5 | 5.88 GB | legacy; medium, balanced quality | ❌ |
|
||||
| Q5_K_S | 5 | 5.88 GB | large, low quality loss | ✅ |
|
||||
| Q5_K_M | 5 | 6.04 GB | large, very low quality loss | ✅ |
|
||||
| Q6_K | 6 | 7.01 GB | very large, extremely low quality loss | ❌ |
|
||||
| Q8_0 | 8 | 9.08 GB | very large, extremely low quality loss | ❌ |
|
||||
| FP16 | 16 | 17.1 GB | enormous, negligible quality loss | ❌ |
|
||||
|
||||
## Usage
|
||||
You can use this model with the latest builds of **LM Studio** and **llama.cpp**.
|
||||
If you're new to the world of _large language models_, I recommend starting with **LM Studio**.
|
||||
<!-- description end -->
|
||||
3
gemma-7b-fp16.gguf
Normal file
3
gemma-7b-fp16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4df20ea2eb82cba9e4106ac6ee87629776cd60a07a02e0d04a7d0666c4ed0248
|
||||
size 17081755936
|
||||
3
gemma-7b.Q2_K-v2.gguf
Normal file
3
gemma-7b.Q2_K-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:fad369df9cc5ac513b260d091bcbc43c004e7ba84a2c5c15604e5fbb7036c95e
|
||||
size 3094374752
|
||||
3
gemma-7b.Q3_K_L-v2.gguf
Normal file
3
gemma-7b.Q3_K_L-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:dc341b435a127925a251cdd9c0f3f2f6d9ee2c3f35aa62dfe63b2121bd1e13ba
|
||||
size 4401867104
|
||||
3
gemma-7b.Q3_K_M-v2.gguf
Normal file
3
gemma-7b.Q3_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:669e9d0c9bfd41417516a52dc684cec301891a6da2a1486b2e8eb6a96c134e09
|
||||
size 4062128480
|
||||
3
gemma-7b.Q3_K_S-v2.gguf
Normal file
3
gemma-7b.Q3_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:a035d19a7f6cc1e0a6a05095761e467fd1c445afdf80cb039c05628b8c7f917a
|
||||
size 3675203936
|
||||
3
gemma-7b.Q4_0-v2.gguf
Normal file
3
gemma-7b.Q4_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e58bbbe5a407f7cac3044e1c3a209e8ee4eb8e920d253bc47dc6853f4563a1a8
|
||||
size 4809091424
|
||||
3
gemma-7b.Q4_K_M-v2.gguf
Normal file
3
gemma-7b.Q4_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5d523fc678f0a8640cb306ca6d706ce7b58e1e331d6a9295e9e3577546df656f
|
||||
size 5127006560
|
||||
3
gemma-7b.Q4_K_S-v2.gguf
Normal file
3
gemma-7b.Q4_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:de353d1e4945395f0465b95c28c3acf34e09d4cf6fdcd95ffe4b4b88cc373dd8
|
||||
size 4843694432
|
||||
3
gemma-7b.Q5_0-v2.gguf
Normal file
3
gemma-7b.Q5_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:1509b000053b4fe017a9d722bec891fb1c1ff4ec1031d87357181c298e5700e0
|
||||
size 5876279648
|
||||
3
gemma-7b.Q5_K_M-v2.gguf
Normal file
3
gemma-7b.Q5_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4454d137becf10728b6e94c5da5a43b2b4d7e49d01c9343d1de26e179eab6d16
|
||||
size 6040054112
|
||||
3
gemma-7b.Q5_K_S-v2.gguf
Normal file
3
gemma-7b.Q5_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:6e43f3a6139f2f0ab867b45a1f72fd024b9cdc7fe2da2e41847e2e1d434d4397
|
||||
size 5876279648
|
||||
3
gemma-7b.Q6_K-v2.gguf
Normal file
3
gemma-7b.Q6_K-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b0765e6a8845ca467f559f139a6ac8a817e53e64b0834df847c3b3ea803edfb0
|
||||
size 7010167136
|
||||
3
gemma-7b.Q8_0-v2.gguf
Normal file
3
gemma-7b.Q8_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:6a945698cac9f296a9d638ecbd0935387477fd0ad682b4be19e372036ea6e8c7
|
||||
size 9077844320
|
||||
Reference in New Issue
Block a user