From 01047be94c0d60df3bb7322ef00640fd5e69408e Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Fri, 31 Jul 2026 12:12:13 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: Mungert/VibeThinker-1.5B-GGUF Source: Original Platform --- .gitattributes | 67 +++++++++++ README.md | 210 +++++++++++++++++++++++++++++++++ VibeThinker-1.5B-bf16.gguf | 3 + VibeThinker-1.5B-f16_q8_0.gguf | 3 + VibeThinker-1.5B-imatrix.gguf | 3 + VibeThinker-1.5B-iq3_m.gguf | 3 + VibeThinker-1.5B-iq3_xs.gguf | 3 + VibeThinker-1.5B-iq3_xxs.gguf | 3 + VibeThinker-1.5B-iq4_nl.gguf | 3 + VibeThinker-1.5B-iq4_xs.gguf | 3 + VibeThinker-1.5B-q3_k_m.gguf | 3 + VibeThinker-1.5B-q3_k_s.gguf | 3 + VibeThinker-1.5B-q4_0.gguf | 3 + VibeThinker-1.5B-q4_1.gguf | 3 + VibeThinker-1.5B-q4_k_m.gguf | 3 + VibeThinker-1.5B-q4_k_s.gguf | 3 + VibeThinker-1.5B-q5_0.gguf | 3 + VibeThinker-1.5B-q5_1.gguf | 3 + VibeThinker-1.5B-q5_k_m.gguf | 3 + VibeThinker-1.5B-q6_k_m.gguf | 3 + VibeThinker-1.5B-q8_0.gguf | 3 + configuration.json | 1 + 22 files changed, 335 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 VibeThinker-1.5B-bf16.gguf create mode 100644 VibeThinker-1.5B-f16_q8_0.gguf create mode 100644 VibeThinker-1.5B-imatrix.gguf create mode 100644 VibeThinker-1.5B-iq3_m.gguf create mode 100644 VibeThinker-1.5B-iq3_xs.gguf create mode 100644 VibeThinker-1.5B-iq3_xxs.gguf create mode 100644 VibeThinker-1.5B-iq4_nl.gguf create mode 100644 VibeThinker-1.5B-iq4_xs.gguf create mode 100644 VibeThinker-1.5B-q3_k_m.gguf create mode 100644 VibeThinker-1.5B-q3_k_s.gguf create mode 100644 VibeThinker-1.5B-q4_0.gguf create mode 100644 VibeThinker-1.5B-q4_1.gguf create mode 100644 VibeThinker-1.5B-q4_k_m.gguf create mode 100644 VibeThinker-1.5B-q4_k_s.gguf create mode 100644 VibeThinker-1.5B-q5_0.gguf create mode 100644 VibeThinker-1.5B-q5_1.gguf create mode 100644 VibeThinker-1.5B-q5_k_m.gguf create mode 100644 VibeThinker-1.5B-q6_k_m.gguf create mode 100644 VibeThinker-1.5B-q8_0.gguf create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..8d7557c --- /dev/null +++ b/.gitattributes @@ -0,0 +1,67 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text + +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text + +VibeThinker-1.5B-f16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q6_k_m.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q4_0.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-iq4_nl.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q4_k_s.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-imatrix.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q5_0.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-iq3_m.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-iq3_xxs.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q4_1.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-iq4_xs.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q3_k_s.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q8_0.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-bf16.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-q5_1.gguf filter=lfs diff=lfs merge=lfs -text +VibeThinker-1.5B-iq3_xs.gguf filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..f768a41 --- /dev/null +++ b/README.md @@ -0,0 +1,210 @@ +--- +license: mit +language: +- en +base_model: +- Qwen/Qwen2.5-Math-1.5B +tags: +- math +- code +- gpqa +pipeline_tag: text-generation +library_name: transformers +--- + +# VibeThinker-1.5B GGUF Models + + +## Model Generation Details + +This model was generated using [llama.cpp](https://github.com/ggerganov/llama.cpp) at commit [`1d45b4228`](https://github.com/ggerganov/llama.cpp/commit/1d45b4228f11c193d6864724ae675734da24ac98). + + + + + + +--- + + + Click here to get info on choosing the right GGUF model format + + +--- + + + + + + +# VibeThinker-1.5B + +

πŸ“ Github   |   πŸ€– Model Scope |   πŸ“„ Techical Report

+ +## Introduction +VibeThinker-1.5B is a 1.5-billion parameter dense language model. With a total training cost of only $7,800 USD, it achieves reasoning performance comparable to larger models like GPT OSS-20B Medium. + +![image](https://cdn-uploads.huggingface.co/production/uploads/64d1faaa1ed6649d70d1fa2f/5bDNf3C0fq9n82kjHLfIb.png) + +## Key Performance Data +πŸ’‘ Mathematical Reasoning: On the three major math benchmarks AIME24, AIME25, and HMMT25, its scores (80.3, 74.4, and 50.4, respectively) all surpass those of the initial DeepSeek R1 model, which has over 400 times the parameters (scores of 79.8, 70.0, and 41.7, respectively). + +🌱 Code Generation: It achieved scores of 55.9 on LiveCodeBench v5 and 51.1 on v6. Its v6 score slightly leads Magistral Medium (50.3), underscoring its strong reasoning performance. + +![image](https://cdn-uploads.huggingface.co/production/uploads/64d1faaa1ed6649d70d1fa2f/jYT1Iq9Jv6vw8Cllr3DuX.png) + +πŸ” On the AIME 25 benchmark, VibeThinker-1.5B significantly extends the Pareto frontier of reasoning accuracy versus model scale, demonstrating that exceptional performance can be achieved with extreme parameter efficiency. + +![image](https://cdn-uploads.huggingface.co/production/uploads/64d1faaa1ed6649d70d1fa2f/RDOrM4MQPQRzLCqPI2_P8.png) + +## Training Pipeline + +![image](https://cdn-uploads.huggingface.co/production/uploads/64d1faaa1ed6649d70d1fa2f/rPfb1GKFQUOICcFs95Aus.png) + +VibeThinker-1.5B's core innovation lies in the "Spectrum-to-Signal Principle" (SSP) training framework: it first explores solution diversity during the Supervised Fine-Tuning (SFT) stage, and then optimizes its policy to reinforce correct signals in the Reinforcement Learning (RL) stage. By systematically integrating these two phases, our approach establishes diversity as the central technical design principle, enabling VibeThinker-1.5B to achieve robust performance that surpasses conventional training paradigms. + +## Usage Guidelines + +**We recommend using this model for competitive-style math and coding problems.** + +To facilitate quick verification by the community, we recommend the following parameter settings: **temperature: 0.6 or 1.0, max token length: 40960, top_p: 0.95, top_k: -1.** + +A more detailed evaluation scheme we have prepared can be found on [GitHub](https://github.com/WeiboAI/VibeThinker/tree/main/eval). + +## Quick Start + +Required: **transformers>=4.54.0** + +Recommended for better inference performance: **vLLM==0.10.1 or SGLang>=0.4.9.post6** + +```python +from transformers import AutoModelForCausalLM, AutoTokenizer, GenerationConfig + + +class VibeThinker: + def __init__(self, model_path): + self.model_path = model_path + self.model = AutoModelForCausalLM.from_pretrained( + self.model_path, + low_cpu_mem_usage=True, + torch_dtype="bfloat16", + device_map="auto" + ) + self.tokenizer = AutoTokenizer.from_pretrained(self.model_path, trust_remote_code=True) + + def infer_text(self, prompt): + messages = [ + {"role": "user", "content": prompt} + ] + text = self.tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True) + model_inputs = self.tokenizer([text], return_tensors="pt").to(self.model.device) + + text = self.tokenizer.apply_chat_template( + messages, + tokenize=False, + add_generation_prompt=True + ) + model_inputs = self.tokenizer([text], return_tensors="pt").to(self.model.device) + + generation_config = dict( + max_new_tokens=40960, + do_sample=True, + temperature=0.6, # 0.6 or 1.0, you can set it according to your needs + top_p=0.95, + top_k=None # in vLLM or SGlang, please set top_k to -1, it means skip top_k for sampling + ) + generated_ids = self.model.generate( + **model_inputs, + generation_config=GenerationConfig(**generation_config) + ) + generated_ids = [ + output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids) + ] + + response = self.tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0] + + return response + + +if __name__ == '__main__': + model = VibeThinker('Your model path') + prompt = 'Your Prompt' + print(model.infer_text(prompt)) +``` + +## License +The model repository is licensed under the MIT License. + + +## Citations & References +If you use VibeThinker in your research or product, please cite: +``` +@misc{xu2025tinymodelbiglogic, + title={Tiny Model, Big Logic: Diversity-Driven Optimization Elicits Large-Model Reasoning Ability in VibeThinker-1.5B}, + author={Sen Xu and Yi Zhou and Wei Wang and Jixin Min and Zhibin Yin and Yingwei Dai and Shixi Liu and Lianyu Pang and Yirong Chen and Junlin Zhang}, + year={2025}, + eprint={2511.06221}, + archivePrefix={arXiv}, + primaryClass={cs.AI}, + url={https://arxiv.org/abs/2511.06221}, +} +``` + + + +--- + +# πŸš€ If you find these models useful + +Help me test my **AI-Powered Quantum Network Monitor Assistant** with **quantum-ready security checks**: + +πŸ‘‰ [Quantum Network Monitor](https://readyforquantum.com/?assistant=open&utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) + + +The full Open Source Code for the Quantum Network Monitor Service available at my github repos ( repos with NetworkMonitor in the name) : [Source Code Quantum Network Monitor](https://github.com/Mungert69). You will also find the code I use to quantize the models if you want to do it yourself [GGUFModelBuilder](https://github.com/Mungert69/GGUFModelBuilder) + +πŸ’¬ **How to test**: + Choose an **AI assistant type**: + - `TurboLLM` (GPT-4.1-mini) + - `HugLLM` (Hugginface Open-source models) + - `TestLLM` (Experimental CPU-only) + +### **What I’m Testing** +I’m pushing the limits of **small open-source models for AI network monitoring**, specifically: +- **Function calling** against live network services +- **How small can a model go** while still handling: + - Automated **Nmap security scans** + - **Quantum-readiness checks** + - **Network Monitoring tasks** + +🟑 **TestLLM** – Current experimental model (llama.cpp on 2 CPU threads on huggingface docker space): +- βœ… **Zero-configuration setup** +- ⏳ 30s load time (slow inference but **no API costs**) . No token limited as the cost is low. +- πŸ”§ **Help wanted!** If you’re into **edge-device AI**, let’s collaborate! + +### **Other Assistants** +🟒 **TurboLLM** – Uses **gpt-4.1-mini** : +- **It performs very well but unfortunatly OpenAI charges per token. For this reason tokens usage is limited. +- **Create custom cmd processors to run .net code on Quantum Network Monitor Agents** +- **Real-time network diagnostics and monitoring** +- **Security Audits** +- **Penetration testing** (Nmap/Metasploit) + +πŸ”΅ **HugLLM** – Latest Open-source models: +- 🌐 Runs on Hugging Face Inference API. Performs pretty well using the lastest models hosted on Novita. + +### πŸ’‘ **Example commands you could test**: +1. `"Give me info on my websites SSL certificate"` +2. `"Check if my server is using quantum safe encyption for communication"` +3. `"Run a comprehensive security audit on my server"` +4. '"Create a cmd processor to .. (what ever you want)" Note you need to install a [Quantum Network Monitor Agent](https://readyforquantum.com/Download/?utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) to run the .net code on. This is a very flexible and powerful feature. Use with caution! + +### Final Word + +I fund the servers used to create these model files, run the Quantum Network Monitor service, and pay for inference from Novita and OpenAIβ€”all out of my own pocket. All the code behind the model creation and the Quantum Network Monitor project is [open source](https://github.com/Mungert69). Feel free to use whatever you find helpful. + +If you appreciate the work, please consider [buying me a coffee](https://www.buymeacoffee.com/mahadeva) β˜•. Your support helps cover service costs and allows me to raise token limits for everyone. + +I'm also open to job opportunities or sponsorship. + +Thank you! 😊 diff --git a/VibeThinker-1.5B-bf16.gguf b/VibeThinker-1.5B-bf16.gguf new file mode 100644 index 0000000..7b39261 --- /dev/null +++ b/VibeThinker-1.5B-bf16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:54f7a1ad3ded9c684a6f1434d5d833b52e517bd6e4d0890e181de571721ea8e7 +size 3560416768 diff --git a/VibeThinker-1.5B-f16_q8_0.gguf b/VibeThinker-1.5B-f16_q8_0.gguf new file mode 100644 index 0000000..be54579 --- /dev/null +++ b/VibeThinker-1.5B-f16_q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:83055454b524c82b151f23123aa2ff89a963a920024f11f9b29f7f0b8907b211 +size 2765628928 diff --git a/VibeThinker-1.5B-imatrix.gguf b/VibeThinker-1.5B-imatrix.gguf new file mode 100644 index 0000000..6053160 --- /dev/null +++ b/VibeThinker-1.5B-imatrix.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1f90df072050333a550cf5e3feabca430ca19cff205f01fc5374beaf6bc4f971 +size 2065952 diff --git a/VibeThinker-1.5B-iq3_m.gguf b/VibeThinker-1.5B-iq3_m.gguf new file mode 100644 index 0000000..d20055b --- /dev/null +++ b/VibeThinker-1.5B-iq3_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:09db54de568fd868f5d92ef0a25da3a42bf6098ef9325de7d5985c5bc7ffe981 +size 996731712 diff --git a/VibeThinker-1.5B-iq3_xs.gguf b/VibeThinker-1.5B-iq3_xs.gguf new file mode 100644 index 0000000..6802c28 --- /dev/null +++ b/VibeThinker-1.5B-iq3_xs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c0d8a9cbd318c9f197f74560cd3cc4f1d6161889dccdb4193bb8379c84d4fedf +size 930302784 diff --git a/VibeThinker-1.5B-iq3_xxs.gguf b/VibeThinker-1.5B-iq3_xxs.gguf new file mode 100644 index 0000000..e176328 --- /dev/null +++ b/VibeThinker-1.5B-iq3_xxs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c4f36698765763349fffdedd21ff3a6888acdfb963c3252c686afeba6b676b31 +size 916454208 diff --git a/VibeThinker-1.5B-iq4_nl.gguf b/VibeThinker-1.5B-iq4_nl.gguf new file mode 100644 index 0000000..18d30d3 --- /dev/null +++ b/VibeThinker-1.5B-iq4_nl.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a078455adc539f75661898c6c445d7deb6190b03e5f9aac82b2f1438a38b0791 +size 1007437632 diff --git a/VibeThinker-1.5B-iq4_xs.gguf b/VibeThinker-1.5B-iq4_xs.gguf new file mode 100644 index 0000000..c318b93 --- /dev/null +++ b/VibeThinker-1.5B-iq4_xs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a8e3ec3942343d243cfdab6d7eabe10b838f8a8d23ab29f8e205d6aee969f437 +size 1087171392 diff --git a/VibeThinker-1.5B-q3_k_m.gguf b/VibeThinker-1.5B-q3_k_m.gguf new file mode 100644 index 0000000..bdcb090 --- /dev/null +++ b/VibeThinker-1.5B-q3_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2bc76f2733f8e293b36f3e3b518b395fe75208b84753281d9e6a6811c5542799 +size 1012177728 diff --git a/VibeThinker-1.5B-q3_k_s.gguf b/VibeThinker-1.5B-q3_k_s.gguf new file mode 100644 index 0000000..c1df6d0 --- /dev/null +++ b/VibeThinker-1.5B-q3_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:76090467f462cfa43fd4faf1432139339854185fd2e58fb32a26d2757025fd71 +size 950187840 diff --git a/VibeThinker-1.5B-q4_0.gguf b/VibeThinker-1.5B-q4_0.gguf new file mode 100644 index 0000000..c409d00 --- /dev/null +++ b/VibeThinker-1.5B-q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:85c5fb9c8117a8e98a0cbe8d308fe16873033f5af4cb854f9310f3e7fc7495b1 +size 1239435072 diff --git a/VibeThinker-1.5B-q4_1.gguf b/VibeThinker-1.5B-q4_1.gguf new file mode 100644 index 0000000..13933a2 --- /dev/null +++ b/VibeThinker-1.5B-q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3c11d793a6732c52a67610136f271862c843929bf90b0fb85d39bf43de3e0997 +size 1146292032 diff --git a/VibeThinker-1.5B-q4_k_m.gguf b/VibeThinker-1.5B-q4_k_m.gguf new file mode 100644 index 0000000..ffe4c42 --- /dev/null +++ b/VibeThinker-1.5B-q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0e138fca39873e938bd00029d6b12d02c4ab6222531c4cbde440d791acf0064d +size 1281017664 diff --git a/VibeThinker-1.5B-q4_k_s.gguf b/VibeThinker-1.5B-q4_k_s.gguf new file mode 100644 index 0000000..fe53c8f --- /dev/null +++ b/VibeThinker-1.5B-q4_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:41e05905be677104dca135a7885f46255ba7d229e3bf26de77196de3a253e6d1 +size 1138830144 diff --git a/VibeThinker-1.5B-q5_0.gguf b/VibeThinker-1.5B-q5_0.gguf new file mode 100644 index 0000000..8047814 --- /dev/null +++ b/VibeThinker-1.5B-q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4f9e2539b9f3dccf78ddbd63274597246a7d27fd35b749d577267151c1fd077e +size 1403209536 diff --git a/VibeThinker-1.5B-q5_1.gguf b/VibeThinker-1.5B-q5_1.gguf new file mode 100644 index 0000000..10683aa --- /dev/null +++ b/VibeThinker-1.5B-q5_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ecf9322f3c7eca738ad7ed6db0aa86f4142f1c6de89fd777c6adb7d15d585758 +size 1485096768 diff --git a/VibeThinker-1.5B-q5_k_m.gguf b/VibeThinker-1.5B-q5_k_m.gguf new file mode 100644 index 0000000..6d84053 --- /dev/null +++ b/VibeThinker-1.5B-q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:92f360441c39762e6e26bb1f946684952c05116d513ff2f1ad6ee520f253439e +size 1431410496 diff --git a/VibeThinker-1.5B-q6_k_m.gguf b/VibeThinker-1.5B-q6_k_m.gguf new file mode 100644 index 0000000..4bea3e8 --- /dev/null +++ b/VibeThinker-1.5B-q6_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:aa4b86b86bd39bcd4e176354553661777869edd518dfcfc11d5be253180472bd +size 1577219904 diff --git a/VibeThinker-1.5B-q8_0.gguf b/VibeThinker-1.5B-q8_0.gguf new file mode 100644 index 0000000..36f26e7 --- /dev/null +++ b/VibeThinker-1.5B-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5c1aa9c68578af69eb64c7428553b6542ab70344bac6b0bb5b5f8420533f1d2c +size 1894532608 diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file