From 798eb16f5aa302e7c4dea4c574dfccf7a50075c5 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Thu, 23 Jul 2026 21:13:09 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: prithivMLmods/LiquidAI-LFM2.5-230M-GGUF Source: Original Platform --- .gitattributes | 50 +++++++++++++++++++++++++++++++++++++++ LFM2.5-230M.BF16.gguf | 3 +++ LFM2.5-230M.F16.gguf | 3 +++ LFM2.5-230M.F32.gguf | 3 +++ LFM2.5-230M.Q2_K.gguf | 3 +++ LFM2.5-230M.Q3_K_L.gguf | 3 +++ LFM2.5-230M.Q3_K_M.gguf | 3 +++ LFM2.5-230M.Q3_K_S.gguf | 3 +++ LFM2.5-230M.Q4_0.gguf | 3 +++ LFM2.5-230M.Q4_K_M.gguf | 3 +++ LFM2.5-230M.Q4_K_S.gguf | 3 +++ LFM2.5-230M.Q5_0.gguf | 3 +++ LFM2.5-230M.Q5_K_M.gguf | 3 +++ LFM2.5-230M.Q5_K_S.gguf | 3 +++ LFM2.5-230M.Q6_K.gguf | 3 +++ LFM2.5-230M.Q8_0.gguf | 3 +++ README.md | 52 +++++++++++++++++++++++++++++++++++++++++ 17 files changed, 147 insertions(+) create mode 100644 .gitattributes create mode 100644 LFM2.5-230M.BF16.gguf create mode 100644 LFM2.5-230M.F16.gguf create mode 100644 LFM2.5-230M.F32.gguf create mode 100644 LFM2.5-230M.Q2_K.gguf create mode 100644 LFM2.5-230M.Q3_K_L.gguf create mode 100644 LFM2.5-230M.Q3_K_M.gguf create mode 100644 LFM2.5-230M.Q3_K_S.gguf create mode 100644 LFM2.5-230M.Q4_0.gguf create mode 100644 LFM2.5-230M.Q4_K_M.gguf create mode 100644 LFM2.5-230M.Q4_K_S.gguf create mode 100644 LFM2.5-230M.Q5_0.gguf create mode 100644 LFM2.5-230M.Q5_K_M.gguf create mode 100644 LFM2.5-230M.Q5_K_S.gguf create mode 100644 LFM2.5-230M.Q6_K.gguf create mode 100644 LFM2.5-230M.Q8_0.gguf create mode 100644 README.md diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..911d8ad --- /dev/null +++ b/.gitattributes @@ -0,0 +1,50 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.F16.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.F32.gguf filter=lfs diff=lfs merge=lfs -text +LFM2.5-230M.BF16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/LFM2.5-230M.BF16.gguf b/LFM2.5-230M.BF16.gguf new file mode 100644 index 0000000..60d2a4d --- /dev/null +++ b/LFM2.5-230M.BF16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1923372a8abc82b39fcdfa72d8236914e7a44db35f5bf56f338a316f6b86986a +size 461884256 diff --git a/LFM2.5-230M.F16.gguf b/LFM2.5-230M.F16.gguf new file mode 100644 index 0000000..d997661 --- /dev/null +++ b/LFM2.5-230M.F16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d2ed0ade4e43256be20f23d8050614262a387bd81abdf95107545d583e2c3781 +size 461884256 diff --git a/LFM2.5-230M.F32.gguf b/LFM2.5-230M.F32.gguf new file mode 100644 index 0000000..bf5ff55 --- /dev/null +++ b/LFM2.5-230M.F32.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ace90f83c48048204e25655a244f4e5837ab0001417f2d5855bc749e0a070ab9 +size 921160544 diff --git a/LFM2.5-230M.Q2_K.gguf b/LFM2.5-230M.Q2_K.gguf new file mode 100644 index 0000000..763fd23 --- /dev/null +++ b/LFM2.5-230M.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:da647398b466adee7bfa2cc9e3c5bc359108672268e73f29a83bea5abcec79ab +size 115673952 diff --git a/LFM2.5-230M.Q3_K_L.gguf b/LFM2.5-230M.Q3_K_L.gguf new file mode 100644 index 0000000..670775e --- /dev/null +++ b/LFM2.5-230M.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5d46ae1b4acb5344f3047bb7c99f28a9cfa9bc301a84395787afca00da6c62aa +size 139389792 diff --git a/LFM2.5-230M.Q3_K_M.gguf b/LFM2.5-230M.Q3_K_M.gguf new file mode 100644 index 0000000..0c023ab --- /dev/null +++ b/LFM2.5-230M.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:36031e6dcc6050fc200f0274005f25b871cebbf15075937d847268e4ec204741 +size 133753696 diff --git a/LFM2.5-230M.Q3_K_S.gguf b/LFM2.5-230M.Q3_K_S.gguf new file mode 100644 index 0000000..c0e3677 --- /dev/null +++ b/LFM2.5-230M.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:24ced83e8ab199a3b37f8cd3b319730e5b3d9d10d2ec5af5a7e79e34e5f1dbc8 +size 127495008 diff --git a/LFM2.5-230M.Q4_0.gguf b/LFM2.5-230M.Q4_0.gguf new file mode 100644 index 0000000..b9a467e --- /dev/null +++ b/LFM2.5-230M.Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:79a11c3f83f2f5568b98973a8cf88d2eb4a3714b6ccdbabb4c8281505af84fc0 +size 149080928 diff --git a/LFM2.5-230M.Q4_K_M.gguf b/LFM2.5-230M.Q4_K_M.gguf new file mode 100644 index 0000000..cf1eb7e --- /dev/null +++ b/LFM2.5-230M.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c71b257ebeb63b37e73ecc70f57655bfbc8cf8ed57514b7ec04378039299632e +size 153406304 diff --git a/LFM2.5-230M.Q4_K_S.gguf b/LFM2.5-230M.Q4_K_S.gguf new file mode 100644 index 0000000..d9bfc26 --- /dev/null +++ b/LFM2.5-230M.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:db2d747e26559a4d6f451283af0691d6ae09afa699a6d6c0c55ef004a544a5b0 +size 149670752 diff --git a/LFM2.5-230M.Q5_0.gguf b/LFM2.5-230M.Q5_0.gguf new file mode 100644 index 0000000..fc48f77 --- /dev/null +++ b/LFM2.5-230M.Q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6978e185fcb5bbbe6a301ec7c26f90db253000f999e347d315e66e49995078d5 +size 169397088 diff --git a/LFM2.5-230M.Q5_K_M.gguf b/LFM2.5-230M.Q5_K_M.gguf new file mode 100644 index 0000000..f0e7d44 --- /dev/null +++ b/LFM2.5-230M.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:67402c69cb08f04dc668ac83060462f85e69b264575f4d6e09731cedcffdb05c +size 171625312 diff --git a/LFM2.5-230M.Q5_K_S.gguf b/LFM2.5-230M.Q5_K_S.gguf new file mode 100644 index 0000000..36b2bfb --- /dev/null +++ b/LFM2.5-230M.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:15aea233605e2e1fffac1d05ecb042f63c81045182ca17fbd4c66ee15e54d2f4 +size 169397088 diff --git a/LFM2.5-230M.Q6_K.gguf b/LFM2.5-230M.Q6_K.gguf new file mode 100644 index 0000000..74d523c --- /dev/null +++ b/LFM2.5-230M.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:03a42bf2cd13ad3b42081f3e79829ff1a8b1baba45c8de3943cd885510322271 +size 190983008 diff --git a/LFM2.5-230M.Q8_0.gguf b/LFM2.5-230M.Q8_0.gguf new file mode 100644 index 0000000..190a16c --- /dev/null +++ b/LFM2.5-230M.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4ac7c9bf5999c276aff7475bcf1ff46012cee9ac1da54770d73b49561c7cfb14 +size 246598496 diff --git a/README.md b/README.md new file mode 100644 index 0000000..dc06bf8 --- /dev/null +++ b/README.md @@ -0,0 +1,52 @@ +--- +license: other +license_name: lfm1.0 +license_link: LICENSE +base_model: +- LiquidAI/LFM2.5-230M +language: +- en +- ar +- zh +- fr +- de +- ja +- ko +- es +- pt +- it +pipeline_tag: text-generation +tags: +- liquid +- lfm2.5 +- edge +library_name: transformers +--- + +# **LiquidAI-LFM2.5-230M-GGUF** + +> **[LFM2.5-230M](https://huggingface.co/LiquidAI/LFM2.5-230M)** is [Liquid AI's](https://huggingface.co/LiquidAI) most compact hybrid model to date, a 230-million-parameter, general-purpose instruction-tuned text model built on the LFM2 architecture with extended pre-training (19T tokens) and reinforcement learning, designed specifically for on-device deployment in the tightest memory and compute budgets. Its 14-layer architecture combines 8 double-gated LIV convolution blocks with 6 GQA blocks, supports a 32,768-token context window across 10 languages, and was distilled from the larger LFM2.5-350M before being refined with multi-stage reinforcement learning, making it well-suited for agentic tasks like tool use and data extraction rather than reasoning-heavy workloads such as advanced math, code generation, or creative writing. It delivers strong edge inference throughput — 213 tok/s decode speed on a Galaxy S25 Ultra and 42 tok/s on a Raspberry Pi 5 — and despite its tiny size, outperforms similarly-scaled competitors like Granite 4.0-350M and LFM2-350M on benchmarks including IFEval (71.71), BFCLv3 (43.26), and Multi-IF (37.70), while supporting native function calling via Pythonic tool calls and ChatML-style chat templates, with deployment options spanning Transformers, vLLM, llama.cpp (GGUF), ONNX, and MLX formats. + +## Model Files + + File Name | Quant Type | File Size | File Link | + |-----------|------------|-----------|-----------| + | LFM2.5-230M.BF16.gguf | BF16 | 462 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.BF16.gguf) | + | LFM2.5-230M.F16.gguf | F16 | 462 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.F16.gguf) | + | LFM2.5-230M.F32.gguf | F32 | 921 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.F32.gguf) | + | LFM2.5-230M.Q2_K.gguf | Q2_K | 116 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q2_K.gguf) | + | LFM2.5-230M.Q3_K_L.gguf | Q3_K_L | 139 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q3_K_L.gguf) | + | LFM2.5-230M.Q3_K_M.gguf | Q3_K_M | 134 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q3_K_M.gguf) | + | LFM2.5-230M.Q3_K_S.gguf | Q3_K_S | 127 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q3_K_S.gguf) | + | LFM2.5-230M.Q4_0.gguf | Q4_0 | 149 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q4_0.gguf) | + | LFM2.5-230M.Q4_K_M.gguf | Q4_K_M | 153 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q4_K_M.gguf) | + | LFM2.5-230M.Q4_K_S.gguf | Q4_K_S | 150 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q4_K_S.gguf) | + | LFM2.5-230M.Q5_0.gguf | Q5_0 | 169 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q5_0.gguf) | + | LFM2.5-230M.Q5_K_M.gguf | Q5_K_M | 172 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q5_K_M.gguf) | + | LFM2.5-230M.Q5_K_S.gguf | Q5_K_S | 169 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q5_K_S.gguf) | + | LFM2.5-230M.Q6_K.gguf | Q6_K | 191 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q6_K.gguf) | + | LFM2.5-230M.Q8_0.gguf | Q8_0 | 247 MB | [Download](https://huggingface.co/prithivMLmods/LiquidAI-LFM2.5-230M-GGUF/blob/main/LFM2.5-230M.Q8_0.gguf) | + +## llama.cpp + +LLM inference in C/C++ — https://github.com/ggml-org/llama.cpp \ No newline at end of file