初始化项目,由ModelHub XC社区提供模型
Model: sayhan/gemma-7b-it-GGUF-quantized Source: Original Platform
This commit is contained in:
59
.gitattributes
vendored
Normal file
59
.gitattributes
vendored
Normal file
@@ -0,0 +1,59 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it-fp16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_L-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q3_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q4_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_K_M-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q5_K_S-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q6_K-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gemma-7b-it.Q8_0-v2.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
51
README.md
Normal file
51
README.md
Normal file
@@ -0,0 +1,51 @@
|
||||
---
|
||||
base_model: google/gemma-7b-it
|
||||
language:
|
||||
- en
|
||||
pipeline_tag: text-generation
|
||||
license: other
|
||||
model_type: gemma
|
||||
library_name: transformers
|
||||
inference: false
|
||||
---
|
||||

|
||||
## Google Gemma 7B Instruct
|
||||
- **Model creator:** [Google](https://huggingface.co/google)
|
||||
- **Original model:** [gemma-7b-it](https://huggingface.co/google/gemma-7b-it)
|
||||
- [**Terms of use**](https://www.kaggle.com/models/google/gemma/license/consent)
|
||||
<!-- description start -->
|
||||
## Description
|
||||
This repo contains GGUF format model files for [Google's Gemma 7B Instruct](https://huggingface.co/google/gemma-7b-it)
|
||||
|
||||
## Original model
|
||||
- **Developed by:** [Google](https://huggingface.co/google)
|
||||
|
||||
### Description
|
||||
Gemma is a family of lightweight, state-of-the-art open models from Google,
|
||||
built from the same research and technology used to create the Gemini models.
|
||||
They are text-to-text, decoder-only large language models, available in English,
|
||||
with open weights, pre-trained variants, and instruction-tuned variants. Gemma
|
||||
models are well-suited for a variety of text generation tasks, including
|
||||
question answering, summarization, and reasoning. Their relatively small size
|
||||
makes it possible to deploy them in environments with limited resources such as
|
||||
a laptop, desktop or your own cloud infrastructure, democratizing access to
|
||||
state of the art AI models and helping foster innovation for everyone.
|
||||
|
||||
## Quantizon types
|
||||
| quantization method | bits | size | description | recommended |
|
||||
|---------------------|------|----------|-----------------------------------------------------|-------------|
|
||||
| Q3_K_S | 3 | 3.68 GB | very small, high quality loss | ❌ |
|
||||
| Q3_K_L | 3 | 4.4 GB | small, substantial quality loss | ❌ |
|
||||
| Q4_0 | 4 | 4.81 GB | legacy; small, very high quality loss | ❌ |
|
||||
| Q4_K_M | 4 | 5.13 GB | medium, balanced quality | ✅ |
|
||||
| Q5_0 | 5 | 5.88 GB | legacy; medium, balanced quality | ❌ |
|
||||
| Q5_K_S | 5 | 5.88 GB | large, low quality loss | ✅ |
|
||||
| Q5_K_M | 5 | 6.04 GB | large, very low quality loss | ✅ |
|
||||
| Q6_K | 6 | 7.01 GB | very large, extremely low quality loss | ❌ |
|
||||
| Q8_0 | 8 | 9.08 GB | very large, extremely low quality loss | ❌ |
|
||||
| FP16 | 16 | 17.1 GB | enormous, negligible quality loss | ❌ |
|
||||
|
||||
## Usage
|
||||
You can use this model with the latest builds of **LM Studio** and **llama.cpp**.
|
||||
If you're new to the world of _large language models_, I recommend starting with **LM Studio**.
|
||||
<!-- description end -->
|
||||
3
gemma-7b-it-fp16.gguf
Normal file
3
gemma-7b-it-fp16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d19e52732bddcb9902347a9c60c117801ad7a3b776b700b9d1649f63f6d80dc0
|
||||
size 17081756544
|
||||
3
gemma-7b-it.Q3_K_L-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_L-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9faa5a960635f5967b70b7f316266f7ddccdd2a71496c0c11c4fbf751ad3bec4
|
||||
size 4401867744
|
||||
3
gemma-7b-it.Q3_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2a30107cc0408bc9e89fba817929979aed868730f07dc063bcfcd8a273d6a3a7
|
||||
size 4062129120
|
||||
3
gemma-7b-it.Q3_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q3_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2de33322c8827fcf52c272355eb37208353f37011fa309744ceec05dce8e44e4
|
||||
size 3675204576
|
||||
3
gemma-7b-it.Q4_0-v2.gguf
Normal file
3
gemma-7b-it.Q4_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ec234811467d551dc51c398d97ba6d4d6dce55eac210483e940e6e57c97309e2
|
||||
size 4809092064
|
||||
3
gemma-7b-it.Q4_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q4_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:457449b3e6f41a6d7d774c06a59e518ae9bb329225c415eea47bca414b2e9643
|
||||
size 5127007200
|
||||
3
gemma-7b-it.Q4_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q4_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:624c5a35bb7e297336e5e2c0868566065b5ce4002c4378a7832790dc2d2ceef5
|
||||
size 4843695072
|
||||
3
gemma-7b-it.Q5_0-v2.gguf
Normal file
3
gemma-7b-it.Q5_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4f12cc04ef24077de544af7db3371b9d4c463aec8bb94a44f36564b6745687f0
|
||||
size 5876280288
|
||||
3
gemma-7b-it.Q5_K_M-v2.gguf
Normal file
3
gemma-7b-it.Q5_K_M-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:528611c83f8a40c3009863ae787c2e21d7db9320c96b708702166280730ce971
|
||||
size 6040054752
|
||||
3
gemma-7b-it.Q5_K_S-v2.gguf
Normal file
3
gemma-7b-it.Q5_K_S-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:29acd8103ba6d88b7846a99796fe59eaeeb39b95640e4268e462ac6e434e8f5e
|
||||
size 5876280288
|
||||
3
gemma-7b-it.Q6_K-v2.gguf
Normal file
3
gemma-7b-it.Q6_K-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:94cbd27f2332c09a265eb3509f05672656827556f98489f902cf941e9b920ce7
|
||||
size 7010167776
|
||||
3
gemma-7b-it.Q8_0-v2.gguf
Normal file
3
gemma-7b-it.Q8_0-v2.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:91f092aa54e2472e66085030edd77d038df72ceaefae7bbf7de1ff3262eb6625
|
||||
size 9077844960
|
||||
Reference in New Issue
Block a user