From 6c5bcbd4abc562c923fa4538d645f2523f9d44f7 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Fri, 31 Jul 2026 11:30:17 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: IlyaGusev/saiga_llama3_8b_gguf Source: Original Platform --- .gitattributes | 36 ++++++++++++++++++++++++++++++++++++ README.md | 34 ++++++++++++++++++++++++++++++++++ model-f16.gguf | 3 +++ model-q2_K.gguf | 3 +++ model-q4_K.gguf | 3 +++ model-q8_0.gguf | 3 +++ 6 files changed, 82 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 model-f16.gguf create mode 100644 model-q2_K.gguf create mode 100644 model-q4_K.gguf create mode 100644 model-q8_0.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..f15b49c --- /dev/null +++ b/.gitattributes @@ -0,0 +1,36 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +*.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..dd8e5b5 --- /dev/null +++ b/README.md @@ -0,0 +1,34 @@ +--- +datasets: +- IlyaGusev/saiga_scored +language: +- ru +inference: false +pipeline_tag: text-generation +license: other +license_name: llama3 +license_link: https://llama.meta.com/llama3/license/ +--- + +Llama.cpp compatible versions of an original [8B model](https://huggingface.co/IlyaGusev/saiga_llama3_8b). + +Download one of the versions, for example `model-q4_K.gguf`. +``` +wget https://huggingface.co/IlyaGusev/saiga_llama3_8b_gguf/resolve/main/model-q4_K.gguf +``` + +Download [interact_llama3_llamacpp.py](https://raw.githubusercontent.com/IlyaGusev/rulm/master/self_instruct/src/interact_llama3_llamacpp.py) +``` +wget https://raw.githubusercontent.com/IlyaGusev/rulm/master/self_instruct/src/interact_llama3_llamacpp.py +``` + +How to run: +``` +pip install llama-cpp-python fire + +python3 interact_llama3_llamacpp.py model-q4_K.gguf +``` + +System requirements: +* 10GB RAM for q8_0 and less for smaller quantizations + diff --git a/model-f16.gguf b/model-f16.gguf new file mode 100644 index 0000000..8803797 --- /dev/null +++ b/model-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e94fc4548a19bb958a2bf42074d5360c87e228d50fc8f4c94c3d4d473671b90b +size 16068890944 diff --git a/model-q2_K.gguf b/model-q2_K.gguf new file mode 100644 index 0000000..aa8c75c --- /dev/null +++ b/model-q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ef8b5dd05e149f6060966a6b645ef115fc8be619a14d201347ae2cb5e92eb92a +size 3179131200 diff --git a/model-q4_K.gguf b/model-q4_K.gguf new file mode 100644 index 0000000..03747db --- /dev/null +++ b/model-q4_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:24286f1721cd6b594530a7a536cb94d5d10568b86eec96f7139bb62cf39ea58b +size 4920734016 diff --git a/model-q8_0.gguf b/model-q8_0.gguf new file mode 100644 index 0000000..ccc78c7 --- /dev/null +++ b/model-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:04947d5085c6d83d4d27257360c16411a4dcdfc174e3c2bf03dcddb56e8724b5 +size 8540770624