初始化项目,由ModelHub XC社区提供模型
Model: iselabvn/Tini-8B-A1B-GGUF Source: Original Platform
This commit is contained in:
39
.gitattributes
vendored
Normal file
39
.gitattributes
vendored
Normal file
@@ -0,0 +1,39 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
Tini-8B-A1B-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Tini-8B-A1B-BF16.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Tini-8B-A1B-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
Tini-8B-A1B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
44
README.md
Normal file
44
README.md
Normal file
@@ -0,0 +1,44 @@
|
||||
---
|
||||
base_model:
|
||||
- dungnvt/Tini-8B-A1B
|
||||
language:
|
||||
- en
|
||||
library_name: transformers
|
||||
tags:
|
||||
- gguf
|
||||
- lfm2_moe
|
||||
- reasoning
|
||||
- agent
|
||||
- function-calling
|
||||
pipeline_tag: text-generation
|
||||
---
|
||||
|
||||
# Tini-8B-A1B-GGUF
|
||||
|
||||
This repository contains GGUF format versions of the fine-tuned model **Tini-8B-A1B**, which is based on the **LiquidAI/LFM2.5-8B-A1B** architecture and optimized for agent reasoning and function-calling.
|
||||
|
||||
## Files Available
|
||||
|
||||
* **Tini-8B-A1B-BF16.gguf** (15.78 GB): Unquantized Brain Float 16 base GGUF file.
|
||||
* **Tini-8B-A1B-Q8_0.gguf** (8.39 GB): 8-bit standard quantization. High accuracy, recommended for general inference.
|
||||
* **Tini-8B-A1B-Q6_K.gguf** (6.48 GB): 6-bit quantization. Good balance between size and perplexity.
|
||||
* **Tini-8B-A1B-Q4_K_M.gguf** (4.80 GB): 4-bit Medium K-quantized model. Highly efficient resource usage.
|
||||
|
||||
## Running the Model
|
||||
|
||||
Since the `lfm2_moe` architecture is relatively new, make sure to use a recent version of `llama.cpp` or downstream tools (LM Studio, Ollama, etc.) that support this model type.
|
||||
|
||||
### Using llama-cli
|
||||
|
||||
You can run the model directly using `llama-cli`:
|
||||
|
||||
```bash
|
||||
llama-cli -m Tini-8B-A1B-Q8_0.gguf -p "<|im_start|>user\nHello, how can you help me today?<|im_end|>\n<|im_start|>assistant\n"
|
||||
```
|
||||
|
||||
## Model Architecture Details
|
||||
|
||||
* **Architecture**: `Lfm2MoeForCausalLM`
|
||||
* **Experts**: 32 experts (MoE)
|
||||
* **Experts per Token**: 4 active experts
|
||||
* **Context Window**: Up to 128k tokens
|
||||
3
Tini-8B-A1B-BF16.gguf
Normal file
3
Tini-8B-A1B-BF16.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d444a342e0d88b412248b3e768ce5a0f6a28604714d72bd7f96ae51777d93149
|
||||
size 16947261472
|
||||
3
Tini-8B-A1B-Q4_K_M.gguf
Normal file
3
Tini-8B-A1B-Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4f4a7cc08ce7a8686a7de6e1d6f2df9839b448b641954f01ecafdb6515355add
|
||||
size 5155565600
|
||||
3
Tini-8B-A1B-Q6_K.gguf
Normal file
3
Tini-8B-A1B-Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3cc1bba2d54356f663fda8be9373090bb292936e2423fc4af8386f59511e4184
|
||||
size 6959788064
|
||||
3
Tini-8B-A1B-Q8_0.gguf
Normal file
3
Tini-8B-A1B-Q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:62dab0cf8a888c8a8596358a4e4797e6579e56a0324ab34a6840b88a0c5834f5
|
||||
size 9010196512
|
||||
Reference in New Issue
Block a user