From 3e1372167d82ea59e0a20d8370ac9998e933faff Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Wed, 2 Sep 2026 13:22:13 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: prithivMLmods/LFM2.5-2.6B-GGUF Source: Original Platform --- .gitattributes | 47 +++++++++++++++++++++++++++++++++ LFM2.5-2.6B.BF16.gguf | 3 +++ LFM2.5-2.6B.F16.gguf | 3 +++ LFM2.5-2.6B.F32.gguf | 3 +++ LFM2.5-2.6B.Q3_K_L.gguf | 3 +++ LFM2.5-2.6B.Q3_K_M.gguf | 3 +++ LFM2.5-2.6B.Q3_K_S.gguf | 3 +++ LFM2.5-2.6B.Q4_K_M.gguf | 3 +++ LFM2.5-2.6B.Q4_K_S.gguf | 3 +++ LFM2.5-2.6B.Q5_K_M.gguf | 3 +++ LFM2.5-2.6B.Q5_K_S.gguf | 3 +++ LFM2.5-2.6B.Q6_K.gguf | 3 +++ LFM2.5-2.6B.Q8_0.gguf | 3 +++ README.md | 57 +++++++++++++++++++++++++++++++++++++++++ configuration.json | 1 + 15 files changed, 141 insertions(+) create mode 100644 .gitattributes create mode 100644 LFM2.5-2.6B.BF16.gguf create mode 100644 LFM2.5-2.6B.F16.gguf create mode 100644 LFM2.5-2.6B.F32.gguf create mode 100644 LFM2.5-2.6B.Q3_K_L.gguf create mode 100644 LFM2.5-2.6B.Q3_K_M.gguf create mode 100644 LFM2.5-2.6B.Q3_K_S.gguf create mode 100644 LFM2.5-2.6B.Q4_K_M.gguf create mode 100644 LFM2.5-2.6B.Q4_K_S.gguf create mode 100644 LFM2.5-2.6B.Q5_K_M.gguf create mode 100644 LFM2.5-2.6B.Q5_K_S.gguf create mode 100644 LFM2.5-2.6B.Q6_K.gguf create mode 100644 LFM2.5-2.6B.Q8_0.gguf create mode 100644 README.md create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/LFM2.5-2.6B.BF16.gguf b/LFM2.5-2.6B.BF16.gguf new file mode 100644 index 0000000..c50753d --- /dev/null +++ b/LFM2.5-2.6B.BF16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:917b46ebb876cfbda1243567a819bd754cdaa8d912508e0030938792182ef66a +size 5403158560 diff --git a/LFM2.5-2.6B.F16.gguf b/LFM2.5-2.6B.F16.gguf new file mode 100644 index 0000000..4bd1590 --- /dev/null +++ b/LFM2.5-2.6B.F16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b5f2c2db47415b69d2da5a860693ed29028d8da43006067965c578ee83409702 +size 5403158560 diff --git a/LFM2.5-2.6B.F32.gguf b/LFM2.5-2.6B.F32.gguf new file mode 100644 index 0000000..318f670 --- /dev/null +++ b/LFM2.5-2.6B.F32.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:288a00e29ab2474484bca9a4478916b2271d1803a31aadfaf68c5142b44fcb70 +size 10797033504 diff --git a/LFM2.5-2.6B.Q3_K_L.gguf b/LFM2.5-2.6B.Q3_K_L.gguf new file mode 100644 index 0000000..a7869bb --- /dev/null +++ b/LFM2.5-2.6B.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a4748557855ab598be03820456228fea2defadcf9944b1ad5fa7702d67d3b359 +size 1451649056 diff --git a/LFM2.5-2.6B.Q3_K_M.gguf b/LFM2.5-2.6B.Q3_K_M.gguf new file mode 100644 index 0000000..6d73d9a --- /dev/null +++ b/LFM2.5-2.6B.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:acfedc49e34128dfb3cad01fb515eb3d55797a0dbfb052ac28cde3278b03f7b2 +size 1366845472 diff --git a/LFM2.5-2.6B.Q3_K_S.gguf b/LFM2.5-2.6B.Q3_K_S.gguf new file mode 100644 index 0000000..414de19 --- /dev/null +++ b/LFM2.5-2.6B.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ab442980c5662fffbf44c4257c4650f69355dfbbb5e02b4aa1306f73e14457d0 +size 1270523936 diff --git a/LFM2.5-2.6B.Q4_K_M.gguf b/LFM2.5-2.6B.Q4_K_M.gguf new file mode 100644 index 0000000..f4c3e14 --- /dev/null +++ b/LFM2.5-2.6B.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:958d529f059f6eefdaa449e7ba58e13dd846f1d0864016ddca747adc3c2316be +size 1674455072 diff --git a/LFM2.5-2.6B.Q4_K_S.gguf b/LFM2.5-2.6B.Q4_K_S.gguf new file mode 100644 index 0000000..ab7c1f9 --- /dev/null +++ b/LFM2.5-2.6B.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dcb4f3962532a56344b2117a1d2cbaf4a9f02f43e7b9aeecfa6f9256de0169b7 +size 1602676768 diff --git a/LFM2.5-2.6B.Q5_K_M.gguf b/LFM2.5-2.6B.Q5_K_M.gguf new file mode 100644 index 0000000..910cbd1 --- /dev/null +++ b/LFM2.5-2.6B.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:07854c1f4d48de8de26d43a08ed9adac41389efd4aba08011f9a76ac79e85a1d +size 1939744800 diff --git a/LFM2.5-2.6B.Q5_K_S.gguf b/LFM2.5-2.6B.Q5_K_S.gguf new file mode 100644 index 0000000..7415ca1 --- /dev/null +++ b/LFM2.5-2.6B.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:279f01ed98c945c318c95e63ecf44602140778929fcbef2e8029515d24cca2ad +size 1898244128 diff --git a/LFM2.5-2.6B.Q6_K.gguf b/LFM2.5-2.6B.Q6_K.gguf new file mode 100644 index 0000000..d1aa3ac --- /dev/null +++ b/LFM2.5-2.6B.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7d2ff28d830a4536e911c8f50d010f3119082671397485e7234b9133bf402fe4 +size 2221615136 diff --git a/LFM2.5-2.6B.Q8_0.gguf b/LFM2.5-2.6B.Q8_0.gguf new file mode 100644 index 0000000..6b31045 --- /dev/null +++ b/LFM2.5-2.6B.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4a327b2986399fe4ad42c707418da8d9db60a7bb90438bcc7153b64d820ffb0e +size 2874779680 diff --git a/README.md b/README.md new file mode 100644 index 0000000..bdb5445 --- /dev/null +++ b/README.md @@ -0,0 +1,57 @@ +--- +library_name: transformers +license: other +license_name: lfm1.0 +license_link: LICENSE +language: +- ar +- zh +- en +- fr +- de +- hi +- id +- it +- ja +- ko +- pl +- pt +- ru +- es +- th +- vi +base_model: +- LiquidAI/LFM2.5-2.6B +pipeline_tag: text-generation +tags: +- text-generation-inference +- llama-cpp +- liquid +- lfm2.5 +- edge +--- + +# **LFM2.5-2.6B-GGUF** + +> **[LFM2.5-2.6B](https://huggingface.co/LiquidAI/LFM2.5-2.6B)** is Liquid AI's agent-focused member of the LFM2.5 hybrid model family, a 2.69-billion-parameter, text-only model built on the LFM2 architecture with a 128K-token context window and post-trained specifically for agentic workloads. Its 30-layer architecture (22 double-gated short convolution blocks plus 8 GQA blocks) was pre-trained on ~34 trillion tokens and then transformed into an agent through a four-stage post-training pipeline — two rounds of supervised fine-tuning, per-domain teacher specialization, multi-domain on-policy distillation, and agentic reinforcement learning trained directly inside popular agentic harnesses — making it a pure reasoning model that always emits a `` block before answering, and supports Pythonic tool calls across 16 languages. Despite its compact size, it proves competitive with models up to 4x larger on tool use, instruction following, and multi-step agentic tasks, outperforming Gemma-4-E4B-it (8B) and rivaling Qwen3.5-9B on benchmarks like IFBench (59.17), Multi-IF (80.07), IFStruct (85.49), and BFCLv4 (56.88), while delivering exceptional efficiency — 220 tok/s on an Apple M5 Max, 113 tok/s on a Ryzen AI Max+ CPU under 2.5GB of memory, and nearly 15K output tokens/sec at high concurrency on a single H100. It's recommended for agentic workloads, tool use, data extraction, RAG, and long-context tasks (though not for agentic coding or knowledge-heavy tasks), ships in native, GGUF, ONNX, and MLX formats, and is released under Liquid AI's LFM1.0 license. + +## Model Files + + File Name | Quant Type | File Size | File Link | + |-----------|------------|-----------|-----------| + | LFM2.5-2.6B.BF16.gguf | BF16 | 5.4 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.BF16.gguf) | + | LFM2.5-2.6B.F16.gguf | F16 | 5.4 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.F16.gguf) | + | LFM2.5-2.6B.F32.gguf | F32 | 10.8 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.F32.gguf) | + | LFM2.5-2.6B.Q3_K_L.gguf | Q3_K_L | 1.45 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q3_K_L.gguf) | + | LFM2.5-2.6B.Q3_K_M.gguf | Q3_K_M | 1.37 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q3_K_M.gguf) | + | LFM2.5-2.6B.Q3_K_S.gguf | Q3_K_S | 1.27 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q3_K_S.gguf) | + | LFM2.5-2.6B.Q4_K_M.gguf | Q4_K_M | 1.67 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q4_K_M.gguf) | + | LFM2.5-2.6B.Q4_K_S.gguf | Q4_K_S | 1.6 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q4_K_S.gguf) | + | LFM2.5-2.6B.Q5_K_M.gguf | Q5_K_M | 1.94 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q5_K_M.gguf) | + | LFM2.5-2.6B.Q5_K_S.gguf | Q5_K_S | 1.9 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q5_K_S.gguf) | + | LFM2.5-2.6B.Q6_K.gguf | Q6_K | 2.22 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q6_K.gguf) | + | LFM2.5-2.6B.Q8_0.gguf | Q8_0 | 2.87 GB | [Download](https://huggingface.co/prithivMLmods/LFM2.5-2.6B-GGUF/blob/main/LFM2.5-2.6B.Q8_0.gguf) | + +## llama.cpp + +LLM inference in C/C++ — https://github.com/ggml-org/llama.cpp \ No newline at end of file diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file