From be049cf4ba24ea60936bdf03202b5586f277a5bd Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 14 Jun 2026 07:28:16 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: mradermacher/MemGUI-8B-SFT-GGUF Source: Original Platform --- .gitattributes | 49 +++++++++++++++++++ MemGUI-8B-SFT.IQ4_XS.gguf | 3 ++ MemGUI-8B-SFT.Q2_K.gguf | 3 ++ MemGUI-8B-SFT.Q3_K_L.gguf | 3 ++ MemGUI-8B-SFT.Q3_K_M.gguf | 3 ++ MemGUI-8B-SFT.Q3_K_S.gguf | 3 ++ MemGUI-8B-SFT.Q4_K_M.gguf | 3 ++ MemGUI-8B-SFT.Q4_K_S.gguf | 3 ++ MemGUI-8B-SFT.Q5_K_M.gguf | 3 ++ MemGUI-8B-SFT.Q5_K_S.gguf | 3 ++ MemGUI-8B-SFT.Q6_K.gguf | 3 ++ MemGUI-8B-SFT.Q8_0.gguf | 3 ++ MemGUI-8B-SFT.f16.gguf | 3 ++ MemGUI-8B-SFT.mmproj-Q8_0.gguf | 3 ++ MemGUI-8B-SFT.mmproj-f16.gguf | 3 ++ README.md | 86 ++++++++++++++++++++++++++++++++++ 16 files changed, 177 insertions(+) create mode 100644 .gitattributes create mode 100644 MemGUI-8B-SFT.IQ4_XS.gguf create mode 100644 MemGUI-8B-SFT.Q2_K.gguf create mode 100644 MemGUI-8B-SFT.Q3_K_L.gguf create mode 100644 MemGUI-8B-SFT.Q3_K_M.gguf create mode 100644 MemGUI-8B-SFT.Q3_K_S.gguf create mode 100644 MemGUI-8B-SFT.Q4_K_M.gguf create mode 100644 MemGUI-8B-SFT.Q4_K_S.gguf create mode 100644 MemGUI-8B-SFT.Q5_K_M.gguf create mode 100644 MemGUI-8B-SFT.Q5_K_S.gguf create mode 100644 MemGUI-8B-SFT.Q6_K.gguf create mode 100644 MemGUI-8B-SFT.Q8_0.gguf create mode 100644 MemGUI-8B-SFT.f16.gguf create mode 100644 MemGUI-8B-SFT.mmproj-Q8_0.gguf create mode 100644 MemGUI-8B-SFT.mmproj-f16.gguf create mode 100644 README.md diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..52c1333 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,49 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.mmproj-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.mmproj-f16.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.f16.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +MemGUI-8B-SFT.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/MemGUI-8B-SFT.IQ4_XS.gguf b/MemGUI-8B-SFT.IQ4_XS.gguf new file mode 100644 index 0000000..1366230 --- /dev/null +++ b/MemGUI-8B-SFT.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:98c849288bb7e49df316c3aaa9dbb3c1fd20a0914061edacba9d0251df5c630d +size 4593298848 diff --git a/MemGUI-8B-SFT.Q2_K.gguf b/MemGUI-8B-SFT.Q2_K.gguf new file mode 100644 index 0000000..f3dc653 --- /dev/null +++ b/MemGUI-8B-SFT.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:15524c26fa2cb30d2318c37852c89cda43f366bb41f733ff1685df899751e170 +size 3281735072 diff --git a/MemGUI-8B-SFT.Q3_K_L.gguf b/MemGUI-8B-SFT.Q3_K_L.gguf new file mode 100644 index 0000000..dfece1e --- /dev/null +++ b/MemGUI-8B-SFT.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ba9934d896fe7138543b62bf904110ac14131683fb1c0db1e0c77b02ccfeb476 +size 4431396256 diff --git a/MemGUI-8B-SFT.Q3_K_M.gguf b/MemGUI-8B-SFT.Q3_K_M.gguf new file mode 100644 index 0000000..a972949 --- /dev/null +++ b/MemGUI-8B-SFT.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f4480d334fd835cb329b8c871c864d89e2095074fec492a7c5747fef459b95c9 +size 4124163488 diff --git a/MemGUI-8B-SFT.Q3_K_S.gguf b/MemGUI-8B-SFT.Q3_K_S.gguf new file mode 100644 index 0000000..086fdf0 --- /dev/null +++ b/MemGUI-8B-SFT.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:19fd0be9130f9db6ccb8ff038094e5698ce203e0cb9a6ee4651ccb065e9a64f1 +size 3769613728 diff --git a/MemGUI-8B-SFT.Q4_K_M.gguf b/MemGUI-8B-SFT.Q4_K_M.gguf new file mode 100644 index 0000000..ff8dd83 --- /dev/null +++ b/MemGUI-8B-SFT.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1e2ff8e2905865bee3309d286fa80813c7ff9d98b4fac796ee60721ce5b9840e +size 5027786144 diff --git a/MemGUI-8B-SFT.Q4_K_S.gguf b/MemGUI-8B-SFT.Q4_K_S.gguf new file mode 100644 index 0000000..7f0f01b --- /dev/null +++ b/MemGUI-8B-SFT.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8b661b6096ccfd8a76002c4e7b4870127a25aa8603b7daf68771a0e76816ea3e +size 4802014624 diff --git a/MemGUI-8B-SFT.Q5_K_M.gguf b/MemGUI-8B-SFT.Q5_K_M.gguf new file mode 100644 index 0000000..241a2b3 --- /dev/null +++ b/MemGUI-8B-SFT.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:194fd29566b36c70a6edd0e25ba632ef1e63e68c773c114dc932a8a8b91d6c0e +size 5851114912 diff --git a/MemGUI-8B-SFT.Q5_K_S.gguf b/MemGUI-8B-SFT.Q5_K_S.gguf new file mode 100644 index 0000000..59591fe --- /dev/null +++ b/MemGUI-8B-SFT.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0faf3a800d41328966663dde098c6a97a1d8a1cba4b47dec8a3e8f71d00b5774 +size 5720763808 diff --git a/MemGUI-8B-SFT.Q6_K.gguf b/MemGUI-8B-SFT.Q6_K.gguf new file mode 100644 index 0000000..7ad876c --- /dev/null +++ b/MemGUI-8B-SFT.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3ad20c098ca1b447a37cb489ee9686e3eae638b4cfd9a7874af103fc348d9d7f +size 6725901728 diff --git a/MemGUI-8B-SFT.Q8_0.gguf b/MemGUI-8B-SFT.Q8_0.gguf new file mode 100644 index 0000000..896a542 --- /dev/null +++ b/MemGUI-8B-SFT.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:06ccfb6ea1d6439bba697e156d1825a4f92249486410c03d59a13cb9ebda99d0 +size 8709520800 diff --git a/MemGUI-8B-SFT.f16.gguf b/MemGUI-8B-SFT.f16.gguf new file mode 100644 index 0000000..2ceb505 --- /dev/null +++ b/MemGUI-8B-SFT.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:727e1788e913fab73dde63f71bf8150e8593a5ab92bded4edec51a07a3fca0fe +size 16388046240 diff --git a/MemGUI-8B-SFT.mmproj-Q8_0.gguf b/MemGUI-8B-SFT.mmproj-Q8_0.gguf new file mode 100644 index 0000000..de09764 --- /dev/null +++ b/MemGUI-8B-SFT.mmproj-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e7852f3adec9af8d05905a03bf6dfcb84a7c9eaca4b95e9add36a347ed70dc53 +size 752290624 diff --git a/MemGUI-8B-SFT.mmproj-f16.gguf b/MemGUI-8B-SFT.mmproj-f16.gguf new file mode 100644 index 0000000..70c264d --- /dev/null +++ b/MemGUI-8B-SFT.mmproj-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:954f32b27a12087e4c33cbbd1eaa660df2193f15d4b353af701964853c0cdd27 +size 1159030720 diff --git a/README.md b/README.md new file mode 100644 index 0000000..b5b97f3 --- /dev/null +++ b/README.md @@ -0,0 +1,86 @@ +--- +base_model: lgy0404/MemGUI-8B-SFT +datasets: +- lgy0404/MemGUI-3K +language: +- en +library_name: transformers +license: apache-2.0 +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +tags: +- qwen3_vl +- gui-agent +- mobile-gui +- android +- memory +- context-management +- conact +- memgui-agent +- long-horizon +--- +## About + + + + + + + + + +static quants of https://huggingface.co/lgy0404/MemGUI-8B-SFT + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#MemGUI-8B-SFT-GGUF).*** + +weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion. +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.mmproj-Q8_0.gguf) | mmproj-Q8_0 | 0.9 | multi-modal supplement | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.mmproj-f16.gguf) | mmproj-f16 | 1.3 | multi-modal supplement | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q2_K.gguf) | Q2_K | 3.4 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q3_K_S.gguf) | Q3_K_S | 3.9 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q3_K_M.gguf) | Q3_K_M | 4.2 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q3_K_L.gguf) | Q3_K_L | 4.5 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.IQ4_XS.gguf) | IQ4_XS | 4.7 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q4_K_S.gguf) | Q4_K_S | 4.9 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q4_K_M.gguf) | Q4_K_M | 5.1 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q5_K_S.gguf) | Q5_K_S | 5.8 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q5_K_M.gguf) | Q5_K_M | 6.0 | | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q6_K.gguf) | Q6_K | 6.8 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.Q8_0.gguf) | Q8_0 | 8.8 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/MemGUI-8B-SFT-GGUF/resolve/main/MemGUI-8B-SFT.f16.gguf) | f16 | 16.5 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +