From 6e2735529be4d264b4485f0ee5084f852013567c Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sat, 12 Sep 2026 20:30:17 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: Open4bits/llama3.2-1b-gguf Source: Original Platform --- .gitattributes | 39 ++++++++++++++++++++ README.md | 83 +++++++++++++++++++++++++++++++++++++++++++ llama3.2-1b-F16.gguf | 3 ++ llama3.2-1b-F32.gguf | 3 ++ llama3.2-1b-Q8_0.gguf | 3 ++ llama3.2-1b-bf16.gguf | 3 ++ 6 files changed, 134 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 llama3.2-1b-F16.gguf create mode 100644 llama3.2-1b-F32.gguf create mode 100644 llama3.2-1b-Q8_0.gguf create mode 100644 llama3.2-1b-bf16.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..f145c80 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,39 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-F16.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-F32.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-bf16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..c905769 --- /dev/null +++ b/README.md @@ -0,0 +1,83 @@ +--- +language: +- en +- de +- fr +- it +- pt +- hi +- es +- th +library_name: transformers +pipeline_tag: text-generation +tags: +- facebook +- meta +- pytorch +- llama +- llama-3 +- open4bits +license: llama3.2 +base_model: +- meta-llama/Llama-3.2-1B +--- +# Open4bits / llama3.2-1b-gguf + +This repository provides the **LLaMA 3.2-1B model converted to GGUF format**, published by Open4bits to enable highly efficient local inference with reduced memory usage and broad CPU compatibility. + +The underlying LLaMA 3.2 model and architecture are **owned by Meta AI**. This repository contains only a quantized GGUF conversion of the original model weights. + +The model is designed for fast, lightweight text generation and instruction-following tasks and is well suited for resource-constrained environments. + +--- + +## Model Overview + +LLaMA (Large Language Model Meta AI) is a family of transformer-based language models developed by Meta AI. +This release uses the **3.2 variant with 1 billion parameters**, striking a balance between performance and efficiency. + +--- + +## Model Details + +* **Architecture:** LLaMA 3.2 +* **Parameters:** ~1 billion +* **Format:** GGUF (quantized) +* **Task:** Text generation, instruction following +* **Weight tying:** Preserved +* **Compatibility:** GGUF-compatible inference runtimes (CPU-focused) + +Compared to larger LLaMA variants, this model offers significantly faster inference with lower memory requirements, with proportionally reduced capacity for complex reasoning. + +--- + +## Intended Use + +This model is intended for: + +* Local text generation and chat applications +* CPU-based or low-resource deployments +* Research, experimentation, and prototyping +* Offline or self-hosted AI systems + +--- + +## Limitations + +* Lower generation quality compared to larger LLaMA 3.2 models +* Output quality depends on prompt design and decoding settings +* Not fine-tuned for domain-specific or high-precision tasks + +--- + +## License + +This model is released under the **original LLaMA 3.2 license terms** as defined by Meta AI. +Users must comply with the licensing conditions of the base LLaMA 3.2-1B model. + +--- + +## Support + +If you find this model useful, please consider supporting the project. +Your support helps Open4bits continue releasing and maintaining high-quality open models for the community. diff --git a/llama3.2-1b-F16.gguf b/llama3.2-1b-F16.gguf new file mode 100644 index 0000000..b905aa6 --- /dev/null +++ b/llama3.2-1b-F16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6fb53cdb01457f448ee9fa1e81171b4f484160848b01cc2f37314cafc5b661cb +size 2479591616 diff --git a/llama3.2-1b-F32.gguf b/llama3.2-1b-F32.gguf new file mode 100644 index 0000000..d0e61b2 --- /dev/null +++ b/llama3.2-1b-F32.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4f7a5c9ada8bf59042134fd25f887e1e3c99931ed84187c2ed2b9e4a9273dbcf +size 4951085248 diff --git a/llama3.2-1b-Q8_0.gguf b/llama3.2-1b-Q8_0.gguf new file mode 100644 index 0000000..d7c009f --- /dev/null +++ b/llama3.2-1b-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:26312279cc9a459942c1ae932d6ed8c03048cbac7c3548b88d5666731d4cf15d +size 1321078976 diff --git a/llama3.2-1b-bf16.gguf b/llama3.2-1b-bf16.gguf new file mode 100644 index 0000000..ea97962 --- /dev/null +++ b/llama3.2-1b-bf16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e48d5b7c0c26467f43b29287810b10f9af5007361afdea8cd9621fecd2201337 +size 2479591616