commit 2bb1cb3990904a95c0ddae64e40cf6d7861db799 Author: ModelHub XC Date: Sun Aug 16 05:53:19 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: brittlewis12/Memphis-CoT-3B-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..0e98055 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,46 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +memphis-cot-3b.fp16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..5cb6fa7 --- /dev/null +++ b/README.md @@ -0,0 +1,92 @@ +--- +base_model: euclaise/Memphis-CoT-3B +datasets: + - euclaise/TinyCoT + - euclaise/reddit-instruct + - sablo/oasst2_curated +license: cc-by-sa-3.0 +language: +- en +model_creator: euclaise +model_name: Memphis-CoT-3B +model_type: stablelm_epoch +inference: false +tags: + - supertrainer2000 + - human-data + - stablelm_epoch +pipeline_tag: text-generation +prompt_template: | + {{system_message}} + ### User: + {{prompt}} + ### Assistant: + +quantized_by: brittlewis12 +--- + +# Memphis-CoT-3B GGUF + +![](https://cdn-uploads.huggingface.co/production/uploads/64137e2150358a805203cbac/DlTWku8gant1yx6NaxqJX.png) + +Original model: [Memphis-CoT-3B](https://huggingface.co/euclaise/Memphis-CoT-3B) +Model creator: [euclaise](https://huggingface.co/euclaise) + +This repo contains GGUF format model files for euclaise’s Memphis-CoT-3B, updated for the latest training run as of 2/2/24. + +> Memphis-CoT is a finetune of StableLM 3b 4e1t on TinyCoT, along with reddit-instruct (subset to 5000 examples, excluding posts with brackets in the title) and a curated subset of oasst2. + + +### What is GGUF? + +GGUF is a file format for representing AI models. It is the third version of the format, introduced by the llama.cpp team on August 21st 2023. It is a replacement for GGML, which is no longer supported by llama.cpp. +Converted using llama.cpp b2022 ([8f8ddfc](https://github.com/ggerganov/llama.cpp/commits/8f8ddfcfadc830b936318c3ea9fe2e8e3365aa85)) + +### Prompt template: + +``` +{{system_message}} +### User: +{{prompt}} +### Assistant: +``` + +or Tiny CoT: +``` +### User: +{{prompt}} +### Rationale: +[...] +### Answer: +``` + +--- + +## Download & run with [cnvrs](https://twitter.com/cnvrsai) on iPhone, iPad, and Mac! + +![cnvrs.ai](https://pbs.twimg.com/profile_images/1744049151241797632/0mIP-P9e_400x400.jpg) + +[cnvrs](https://testflight.apple.com/join/sFWReS7K) is the best app for private, local AI on your device: +- create & save **Characters** with custom system prompts & temperature settings +- download and experiment with any **GGUF model** you can [find on HuggingFace](https://huggingface.co/models?library=gguf)! +- make it your own with custom **Theme colors** +- powered by Metal ⚡️ & [Llama.cpp](https://github.com/ggerganov/llama.cpp), with **haptics** during response streaming! +- **try it out** yourself today, on [Testflight](https://testflight.apple.com/join/sFWReS7K)! +- follow [cnvrs on twitter](https://twitter.com/cnvrsai) to stay up to date + +--- + +## Original Model Evaluations: + +| Model | Size | Data | Method | GSM8K (5-shot) | AGIEval (English/Nous subset, acc_norm) | BIG Bench Hard (CoT, few-shot*) | +|:-----------------------------------------------------------------------|--------|:--------------------|---------------|:---------------|:----------------------------------------|:------------------------------ | +| [StableLM 3B Base](https://hf.co/stabilityai/stablelm-3b-4e1t) | 3B | Base | Base | 2.05% | 25.14% | 36.75% | +| [StableHermes 3B](https://hf.co/cxllin/StableHermes-3b) | 3B | GPT | SFT | 3.64% | 24.31% | *37.28%* | +| [MPT 7B Instruct](https://hf.co/mosaicml/mpt-7b-instruct) | **7B** | **Human**+Anthropic | SFT | 2.05% | 24.12% | 11.01% | +| [OpenLLaMA 7B v2 open-instruct](http://hf.co/VMware/open-llama-7b-v2-open-instruct) | **7B** | **Human** (nearly: ecqa is an exception) | SFT | 8.64% | 23.21% | 29.84% | +| [StableLM Zephyr 3B](https://hf.co/stabilityai/stablelm-zephyr-3b) | 3B | GPT | DPO | possibly contaminated (45.72%) | **33.31%** | 0.91% | +| [**Memphis-CoT 3B**](https://hf.co/euclaise/memphis-cot-3b) | 3B | **Human** | Self-teaching | **13.8%** | *26.24%* | **38.24%** | + +*5-shot, as performed automatically by LM Evaluation Harness bbh_cot_fewshot even with num_fewshot=0 + +> Memphis outperforms other primarily-human-data models that are over twice its size, along with SFT models of its size, and trades with the Zephyr DPO model. That said, Zephyr uses synthetic data, and *much* more of it. \ No newline at end of file diff --git a/memphis-cot-3b.Q2_K.gguf b/memphis-cot-3b.Q2_K.gguf new file mode 100644 index 0000000..fa29d28 --- /dev/null +++ b/memphis-cot-3b.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:623705c03e027f58288865a315f5f3a4e3de852a3ea5dfc53ec7439859ebcbf8 +size 1083755936 diff --git a/memphis-cot-3b.Q3_K_L.gguf b/memphis-cot-3b.Q3_K_L.gguf new file mode 100644 index 0000000..80aa440 --- /dev/null +++ b/memphis-cot-3b.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c0937d32fa4a5f6a0d69d99876e1632dc4189a80a3e219f8b4c75d4a0b93ed4d +size 1508564896 diff --git a/memphis-cot-3b.Q3_K_M.gguf b/memphis-cot-3b.Q3_K_M.gguf new file mode 100644 index 0000000..5a13b07 --- /dev/null +++ b/memphis-cot-3b.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:58a28e76133c5e6587a331b199a6e4d56f229dc56dac760662e098ebea10750d +size 1391419296 diff --git a/memphis-cot-3b.Q3_K_S.gguf b/memphis-cot-3b.Q3_K_S.gguf new file mode 100644 index 0000000..fc34ff1 --- /dev/null +++ b/memphis-cot-3b.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:de9017037a52389c45206400240e21bc6510f047ecd6b27f3661aa09e8ac44e1 +size 1254449056 diff --git a/memphis-cot-3b.Q4_K_M.gguf b/memphis-cot-3b.Q4_K_M.gguf new file mode 100644 index 0000000..70d7746 --- /dev/null +++ b/memphis-cot-3b.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4d4456e61c282806b3f9ec941c45c28ea682a6d654aae60f3e8848c12c91a295 +size 1708595616 diff --git a/memphis-cot-3b.Q4_K_S.gguf b/memphis-cot-3b.Q4_K_S.gguf new file mode 100644 index 0000000..dee11f2 --- /dev/null +++ b/memphis-cot-3b.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4af89a7fa9d3d10d0e6fd4dccc28e1b973deb5696a7106ea28a789508be95f29 +size 1620695456 diff --git a/memphis-cot-3b.Q5_K_M.gguf b/memphis-cot-3b.Q5_K_M.gguf new file mode 100644 index 0000000..876919c --- /dev/null +++ b/memphis-cot-3b.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dd9fe63c50700a9e1fed8073e814bdbc79becb337ace7d96d5a495d6f73c7a88 +size 1993390496 diff --git a/memphis-cot-3b.Q5_K_S.gguf b/memphis-cot-3b.Q5_K_S.gguf new file mode 100644 index 0000000..7bbc055 --- /dev/null +++ b/memphis-cot-3b.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:41e1b217517de05e80134aa71886c9a83c2c4ff5a81f61cfb4b27a2a6f89ee5d +size 1941862816 diff --git a/memphis-cot-3b.Q6_K.gguf b/memphis-cot-3b.Q6_K.gguf new file mode 100644 index 0000000..548a87e --- /dev/null +++ b/memphis-cot-3b.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2f55942102479b4e1acefd0a2788f3498aac4c8c1f26e84e1d1a494d7ab0b970 +size 2295985056 diff --git a/memphis-cot-3b.Q8_0.gguf b/memphis-cot-3b.Q8_0.gguf new file mode 100644 index 0000000..1c3a738 --- /dev/null +++ b/memphis-cot-3b.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:865d593632f922ead60cc82e9e3843ebaaa667655850644291466bc9fdba22ca +size 2972925856 diff --git a/memphis-cot-3b.fp16.gguf b/memphis-cot-3b.fp16.gguf new file mode 100644 index 0000000..e70c266 --- /dev/null +++ b/memphis-cot-3b.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2a6f908ab67f1f15b30406968dafdec44e4975931eaaa486d6140541b55cc74b +size 5593341760