初始化项目,由ModelHub XC社区提供模型

Model: liodon-ai/LFM2.5-8B-A1B-imatrix-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-07 23:57:20 +08:00
commit 9058ff9a2a
9 changed files with 130 additions and 0 deletions

42
.gitattributes vendored Normal file
View File

@@ -0,0 +1,42 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
LFM2.5-8B-A1B-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text

3
LFM2.5-8B-A1B-IQ2_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5a892fb8703c570b39f1a86eba93de0640ff9418ad3f54d419f026cbcb0060f0
size 2843274816

3
LFM2.5-8B-A1B-IQ3_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e04847dd766b30bb510e9a80af47cff97393eac8b55a1d4cc3e17d93eff7ece8
size 3778752064

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2237675ffa1c2d5a277db4ef02b79e613fc172d4b63511ae8cbcb8c3d75d1148
size 4588301888

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5a74e6ea603b48db084c9ee49e56c59e8ab86b4189c4c7ea6a25dcedbbfc2fcd
size 5155565120

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dc8cde558bcc56ff10e085a07c3c200608a7b097556a4d4073e1db4da7492a0d
size 6030339648

3
LFM2.5-8B-A1B-Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:2068b01ff7a7961ceee28cf95ba6f7853dbf3d727ae5e214b5cedf52def6ad19
size 6959787584

3
LFM2.5-8B-A1B-Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:17747800f8f7a91aab73399c82391752c152ca2c1a342a205a47d7388f5f7348
size 9010196032

67
README.md Normal file
View File

@@ -0,0 +1,67 @@
---
license: other
base_model: LiquidAI/LFM2.5-8B-A1B
base_model_relation: quantized
pipeline_tag: text-generation
library_name: gguf
tags:
- gguf
- ollama
- local-llm
- llama.cpp
- lm-studio
- quantized
- imatrix
- sub-4-bit
quantized_by: liodon-ai
---
# LFM2.5-8B-A1B — iMatrix GGUF
GGUF quantizations of [LiquidAI/LFM2.5-8B-A1B](https://huggingface.co/LiquidAI/LFM2.5-8B-A1B), published by [Liodon AI](https://huggingface.co/liodon-ai).
## Quick Start
**llama.cpp**
```bash
llama-cli -hf liodon-ai/LFM2.5-8B-A1B-imatrix-GGUF:Q4_K_M
```
**Ollama**
```bash
ollama run hf.co/liodon-ai/LFM2.5-8B-A1B-imatrix-GGUF:Q4_K_M
```
**LM Studio / Jan** — search `liodon-ai/LFM2.5-8B-A1B-imatrix-GGUF` and pick your quant.
## Quants
| Quant | Size | VRAM est. | Notes |
|-------|------|-----------|-------|
| `IQ2_M` | 2.84 GB | ~3 GB | 2-bit, iMatrix — smallest usable |
| `IQ3_M` | 3.78 GB | ~4 GB | 3-bit, iMatrix — great quality/size tradeoff |
| `IQ4_XS` | 4.59 GB | ~5 GB | 4-bit extra-small, iMatrix |
| `Q4_K_M` | 5.16 GB | ~6 GB | 4-bit, iMatrix-calibrated (recommended) |
| `Q5_K_M` | 6.03 GB | ~7 GB | 5-bit, iMatrix-calibrated |
| `Q6_K` | 6.96 GB | ~8 GB | 6-bit, iMatrix-calibrated, near-lossless |
| `Q8_0` | 9.01 GB | ~10 GB | 8-bit, essentially lossless |
## What is iMatrix?
Standard quantization treats all weights equally. iMatrix runs 128 calibration chunks through
the full-precision model to find which weights matter most, then allocates more precision where
it counts. At Q2/Q3/Q4 this means noticeably better coherence and instruction-following —
**same file size, better output**.
Calibration: 2M tokens of [WikiText-103](https://huggingface.co/datasets/wikitext).
> Also see plain (non-iMatrix) quants: `liodon-ai/LFM2.5-8B-A1B-GGUF`
## Source
- **Model**: [LiquidAI/LFM2.5-8B-A1B](https://huggingface.co/LiquidAI/LFM2.5-8B-A1B)
- **License**: other
---
*Quantized by [Liodon AI](https://huggingface.co/liodon-ai)*