commit 6e2735529be4d264b4485f0ee5084f852013567c Author: ModelHub XC Date: Sat Sep 12 20:30:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: Open4bits/llama3.2-1b-gguf Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..f145c80 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,39 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-F16.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-F32.gguf filter=lfs diff=lfs merge=lfs -text +llama3.2-1b-bf16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..c905769 --- /dev/null +++ b/README.md @@ -0,0 +1,83 @@ +--- +language: +- en +- de +- fr +- it +- pt +- hi +- es +- th +library_name: transformers +pipeline_tag: text-generation +tags: +- facebook +- meta +- pytorch +- llama +- llama-3 +- open4bits +license: llama3.2 +base_model: +- meta-llama/Llama-3.2-1B +--- +# Open4bits / llama3.2-1b-gguf + +This repository provides the **LLaMA 3.2-1B model converted to GGUF format**, published by Open4bits to enable highly efficient local inference with reduced memory usage and broad CPU compatibility. + +The underlying LLaMA 3.2 model and architecture are **owned by Meta AI**. This repository contains only a quantized GGUF conversion of the original model weights. + +The model is designed for fast, lightweight text generation and instruction-following tasks and is well suited for resource-constrained environments. + +--- + +## Model Overview + +LLaMA (Large Language Model Meta AI) is a family of transformer-based language models developed by Meta AI. +This release uses the **3.2 variant with 1 billion parameters**, striking a balance between performance and efficiency. + +--- + +## Model Details + +* **Architecture:** LLaMA 3.2 +* **Parameters:** ~1 billion +* **Format:** GGUF (quantized) +* **Task:** Text generation, instruction following +* **Weight tying:** Preserved +* **Compatibility:** GGUF-compatible inference runtimes (CPU-focused) + +Compared to larger LLaMA variants, this model offers significantly faster inference with lower memory requirements, with proportionally reduced capacity for complex reasoning. + +--- + +## Intended Use + +This model is intended for: + +* Local text generation and chat applications +* CPU-based or low-resource deployments +* Research, experimentation, and prototyping +* Offline or self-hosted AI systems + +--- + +## Limitations + +* Lower generation quality compared to larger LLaMA 3.2 models +* Output quality depends on prompt design and decoding settings +* Not fine-tuned for domain-specific or high-precision tasks + +--- + +## License + +This model is released under the **original LLaMA 3.2 license terms** as defined by Meta AI. +Users must comply with the licensing conditions of the base LLaMA 3.2-1B model. + +--- + +## Support + +If you find this model useful, please consider supporting the project. +Your support helps Open4bits continue releasing and maintaining high-quality open models for the community. diff --git a/llama3.2-1b-F16.gguf b/llama3.2-1b-F16.gguf new file mode 100644 index 0000000..b905aa6 --- /dev/null +++ b/llama3.2-1b-F16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6fb53cdb01457f448ee9fa1e81171b4f484160848b01cc2f37314cafc5b661cb +size 2479591616 diff --git a/llama3.2-1b-F32.gguf b/llama3.2-1b-F32.gguf new file mode 100644 index 0000000..d0e61b2 --- /dev/null +++ b/llama3.2-1b-F32.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4f7a5c9ada8bf59042134fd25f887e1e3c99931ed84187c2ed2b9e4a9273dbcf +size 4951085248 diff --git a/llama3.2-1b-Q8_0.gguf b/llama3.2-1b-Q8_0.gguf new file mode 100644 index 0000000..d7c009f --- /dev/null +++ b/llama3.2-1b-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:26312279cc9a459942c1ae932d6ed8c03048cbac7c3548b88d5666731d4cf15d +size 1321078976 diff --git a/llama3.2-1b-bf16.gguf b/llama3.2-1b-bf16.gguf new file mode 100644 index 0000000..ea97962 --- /dev/null +++ b/llama3.2-1b-bf16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e48d5b7c0c26467f43b29287810b10f9af5007361afdea8cd9621fecd2201337 +size 2479591616