From 9952060fb93aa88b2b8e8926ab38edd8b9dddd6d Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Tue, 21 Jul 2026 10:04:05 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: Mungert/rwkv7-2.9B-g1-GGUF Source: Original Platform --- .gitattributes | 71 ++++++++++++++ README.md | 185 +++++++++++++++++++++++++++++++++++ configuration.json | 1 + rwkv7-2.9B-g1-bf16.gguf | 3 + rwkv7-2.9B-g1-bf16_q8_0.gguf | 3 + rwkv7-2.9B-g1-f16_q8_0.gguf | 3 + rwkv7-2.9B-g1-imatrix.gguf | 3 + rwkv7-2.9B-g1-iq3_m.gguf | 3 + rwkv7-2.9B-g1-iq3_s.gguf | 3 + rwkv7-2.9B-g1-iq3_xs.gguf | 3 + rwkv7-2.9B-g1-iq3_xxs.gguf | 3 + rwkv7-2.9B-g1-iq4_nl.gguf | 3 + rwkv7-2.9B-g1-iq4_xs.gguf | 3 + rwkv7-2.9B-g1-q3_k_m.gguf | 3 + rwkv7-2.9B-g1-q3_k_s.gguf | 3 + rwkv7-2.9B-g1-q4_0.gguf | 3 + rwkv7-2.9B-g1-q4_1.gguf | 3 + rwkv7-2.9B-g1-q4_k_m.gguf | 3 + rwkv7-2.9B-g1-q4_k_s.gguf | 3 + rwkv7-2.9B-g1-q5_0.gguf | 3 + rwkv7-2.9B-g1-q5_1.gguf | 3 + rwkv7-2.9B-g1-q5_k_m.gguf | 3 + rwkv7-2.9B-g1-q5_k_s.gguf | 3 + rwkv7-2.9B-g1-q6_k_m.gguf | 3 + rwkv7-2.9B-g1-q8_0.gguf | 3 + rwkv7-2.9B-g1.imatrix | 3 + 26 files changed, 326 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 configuration.json create mode 100644 rwkv7-2.9B-g1-bf16.gguf create mode 100644 rwkv7-2.9B-g1-bf16_q8_0.gguf create mode 100644 rwkv7-2.9B-g1-f16_q8_0.gguf create mode 100644 rwkv7-2.9B-g1-imatrix.gguf create mode 100644 rwkv7-2.9B-g1-iq3_m.gguf create mode 100644 rwkv7-2.9B-g1-iq3_s.gguf create mode 100644 rwkv7-2.9B-g1-iq3_xs.gguf create mode 100644 rwkv7-2.9B-g1-iq3_xxs.gguf create mode 100644 rwkv7-2.9B-g1-iq4_nl.gguf create mode 100644 rwkv7-2.9B-g1-iq4_xs.gguf create mode 100644 rwkv7-2.9B-g1-q3_k_m.gguf create mode 100644 rwkv7-2.9B-g1-q3_k_s.gguf create mode 100644 rwkv7-2.9B-g1-q4_0.gguf create mode 100644 rwkv7-2.9B-g1-q4_1.gguf create mode 100644 rwkv7-2.9B-g1-q4_k_m.gguf create mode 100644 rwkv7-2.9B-g1-q4_k_s.gguf create mode 100644 rwkv7-2.9B-g1-q5_0.gguf create mode 100644 rwkv7-2.9B-g1-q5_1.gguf create mode 100644 rwkv7-2.9B-g1-q5_k_m.gguf create mode 100644 rwkv7-2.9B-g1-q5_k_s.gguf create mode 100644 rwkv7-2.9B-g1-q6_k_m.gguf create mode 100644 rwkv7-2.9B-g1-q8_0.gguf create mode 100644 rwkv7-2.9B-g1.imatrix diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..d20038f --- /dev/null +++ b/.gitattributes @@ -0,0 +1,71 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text + +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text + +rwkv7-2.9B-g1-iq3_s.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-f16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-iq3_m.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-bf16.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q3_k_s.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-iq4_xs.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-iq4_nl.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q8_0.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q4_1.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q4_0.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-iq3_xs.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q4_k_s.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-imatrix.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-bf16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-iq3_xxs.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1.imatrix filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q5_0.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q5_1.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q6_k_m.gguf filter=lfs diff=lfs merge=lfs -text +rwkv7-2.9B-g1-q5_k_s.gguf filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..0c07556 --- /dev/null +++ b/README.md @@ -0,0 +1,185 @@ +--- +license: apache-2.0 +language: +- en +- zh +- ja +- ko +- fr +- ar +- es +- pt +metrics: +- accuracy +base_model: +- BlinkDL/rwkv7-g1 +pipeline_tag: text-generation +--- + +# rwkv7-2.9B-g1 GGUF Models + + +## Model Generation Details + +This model was generated using [llama.cpp](https://github.com/ggerganov/llama.cpp) at commit [`4807e8f9`](https://github.com/ggerganov/llama.cpp/commit/4807e8f96a61b2adccebd5e57444c94d18de7264). + + + + + + +--- + + + Click here to get info on choosing the right GGUF model format + + +--- + + + + + + +# rwkv7-2.9B-g1 + + + +This is RWKV-7 model under flash-linear attention format. + +## Model Details + +### Model Description + + + +- **Developed by:** Bo Peng, Yu Zhang, Songlin Yang, Ruichong Zhang, Zhiyuan Li +- **Funded by:** RWKV Project (Under LF AI & Data Foundation) +- **Model type:** RWKV7 +- **Language(s) (NLP):** Multilingual +- **License:** Apache-2.0 +- **Parameter count:** 2.9B +- **Tokenizer:** RWKV World tokenizer +- **Vocabulary size:** 65,536 + +### Model Sources + + + +- **Repository:** https://github.com/fla-org/flash-linear-attention ; https://github.com/BlinkDL/RWKV-LM +- **Paper:** https://arxiv.org/abs/2503.14456 +- **Model:** https://huggingface.co/BlinkDL/rwkv7-g1/resolve/main/rwkv7-g1-2.9b-20250519-ctx4096.pth + +## Uses + + +Install `flash-linear-attention` and the latest version of `transformers` before using this model: + +```bash +pip install git+https://github.com/fla-org/flash-linear-attention +pip install 'transformers>=4.48.0' +``` + +### Direct Use + + +You can use this model just as any other HuggingFace models: +```python +from transformers import AutoModelForCausalLM, AutoTokenizer +model = AutoModelForCausalLM.from_pretrained('fla-hub/rwkv7-2.9B-g1', trust_remote_code=True) +tokenizer = AutoTokenizer.from_pretrained('fla-hub/rwkv7-2.9B-g1', trust_remote_code=True) +model = model.cuda() # Supported on Nvidia/AMD/Intel eg. model.xpu() +prompt = "What is a large language model?" +messages = [ + {"role": "user", "content": prompt} +] +text = tokenizer.apply_chat_template( + messages, + tokenize=False, + add_generation_prompt=True, + enable_thinking=True # Default is True, set to False to disable thinking +) + +model_inputs = tokenizer([text], return_tensors="pt").to(model.device) +generated_ids = model.generate( + **model_inputs, + max_new_tokens=1024, + do_sample=True, + temperature=1.0, + top_p=0.3, + repetition_penalty=1.2 +) +generated_ids = [ + output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids) +] + +response = tokenizer.batch_decode(generated_ids, skip_special_tokens=False)[0] +print(response) + +``` + + +## FAQ +Q: safetensors metadata is none. + +A: upgrade transformers to >=4.48.0: `pip install 'transformers>=4.48.0'` + + + + +--- + +# πŸš€ If you find these models useful + +Help me test my **AI-Powered Quantum Network Monitor Assistant** with **quantum-ready security checks**: + +πŸ‘‰ [Quantum Network Monitor](https://readyforquantum.com/?assistant=open&utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) + + +The full Open Source Code for the Quantum Network Monitor Service available at my github repos ( repos with NetworkMonitor in the name) : [Source Code Quantum Network Monitor](https://github.com/Mungert69). You will also find the code I use to quantize the models if you want to do it yourself [GGUFModelBuilder](https://github.com/Mungert69/GGUFModelBuilder) + +πŸ’¬ **How to test**: + Choose an **AI assistant type**: + - `TurboLLM` (GPT-4.1-mini) + - `HugLLM` (Hugginface Open-source models) + - `TestLLM` (Experimental CPU-only) + +### **What I’m Testing** +I’m pushing the limits of **small open-source models for AI network monitoring**, specifically: +- **Function calling** against live network services +- **How small can a model go** while still handling: + - Automated **Nmap security scans** + - **Quantum-readiness checks** + - **Network Monitoring tasks** + +🟑 **TestLLM** – Current experimental model (llama.cpp on 2 CPU threads on huggingface docker space): +- βœ… **Zero-configuration setup** +- ⏳ 30s load time (slow inference but **no API costs**) . No token limited as the cost is low. +- πŸ”§ **Help wanted!** If you’re into **edge-device AI**, let’s collaborate! + +### **Other Assistants** +🟒 **TurboLLM** – Uses **gpt-4.1-mini** : +- **It performs very well but unfortunatly OpenAI charges per token. For this reason tokens usage is limited. +- **Create custom cmd processors to run .net code on Quantum Network Monitor Agents** +- **Real-time network diagnostics and monitoring** +- **Security Audits** +- **Penetration testing** (Nmap/Metasploit) + +πŸ”΅ **HugLLM** – Latest Open-source models: +- 🌐 Runs on Hugging Face Inference API. Performs pretty well using the lastest models hosted on Novita. + +### πŸ’‘ **Example commands you could test**: +1. `"Give me info on my websites SSL certificate"` +2. `"Check if my server is using quantum safe encyption for communication"` +3. `"Run a comprehensive security audit on my server"` +4. '"Create a cmd processor to .. (what ever you want)" Note you need to install a [Quantum Network Monitor Agent](https://readyforquantum.com/Download/?utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) to run the .net code on. This is a very flexible and powerful feature. Use with caution! + +### Final Word + +I fund the servers used to create these model files, run the Quantum Network Monitor service, and pay for inference from Novita and OpenAIβ€”all out of my own pocket. All the code behind the model creation and the Quantum Network Monitor project is [open source](https://github.com/Mungert69). Feel free to use whatever you find helpful. + +If you appreciate the work, please consider [buying me a coffee](https://www.buymeacoffee.com/mahadeva) β˜•. Your support helps cover service costs and allows me to raise token limits for everyone. + +I'm also open to job opportunities or sponsorship. + +Thank you! 😊 diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file diff --git a/rwkv7-2.9B-g1-bf16.gguf b/rwkv7-2.9B-g1-bf16.gguf new file mode 100644 index 0000000..c7ce5e0 --- /dev/null +++ b/rwkv7-2.9B-g1-bf16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9bdbea6da1000a57dc7e0c29811c22370dab340de8b0d64f01a55abef6dbd560 +size 5932472832 diff --git a/rwkv7-2.9B-g1-bf16_q8_0.gguf b/rwkv7-2.9B-g1-bf16_q8_0.gguf new file mode 100644 index 0000000..b2a6d6f --- /dev/null +++ b/rwkv7-2.9B-g1-bf16_q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:06bba3e9bd52ca4c1192c3dee56d379b33475ed0bc768aadd61e35f63a0ee0c0 +size 3573176160 diff --git a/rwkv7-2.9B-g1-f16_q8_0.gguf b/rwkv7-2.9B-g1-f16_q8_0.gguf new file mode 100644 index 0000000..0d516b2 --- /dev/null +++ b/rwkv7-2.9B-g1-f16_q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:966e51a285b33fbc53010f68f341085316deeccaf9eed1ed9551823c2f6d6e09 +size 3573176832 diff --git a/rwkv7-2.9B-g1-imatrix.gguf b/rwkv7-2.9B-g1-imatrix.gguf new file mode 100644 index 0000000..bab4ecd --- /dev/null +++ b/rwkv7-2.9B-g1-imatrix.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0ee26a8244217c63a5974d716417fffc9b15c94fc03967f68be5e58fdf50a8a7 +size 4396544 diff --git a/rwkv7-2.9B-g1-iq3_m.gguf b/rwkv7-2.9B-g1-iq3_m.gguf new file mode 100644 index 0000000..a6c07a0 --- /dev/null +++ b/rwkv7-2.9B-g1-iq3_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:30c53a526800eaab2f86849560863f7b3588e4d2a9eb2e434d89a2133005b720 +size 1584814912 diff --git a/rwkv7-2.9B-g1-iq3_s.gguf b/rwkv7-2.9B-g1-iq3_s.gguf new file mode 100644 index 0000000..6f29d08 --- /dev/null +++ b/rwkv7-2.9B-g1-iq3_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d89aef706f00b9622e5caf7dcbbb721b6dd29910828399637fb12b9e8129f185 +size 1540249760 diff --git a/rwkv7-2.9B-g1-iq3_xs.gguf b/rwkv7-2.9B-g1-iq3_xs.gguf new file mode 100644 index 0000000..3e47e01 --- /dev/null +++ b/rwkv7-2.9B-g1-iq3_xs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:10c43ea85217cfa27ad2a90cfdea88e4e1a6f90f3e04e4509d43fccbdfe77232 +size 1584814912 diff --git a/rwkv7-2.9B-g1-iq3_xxs.gguf b/rwkv7-2.9B-g1-iq3_xxs.gguf new file mode 100644 index 0000000..ac92807 --- /dev/null +++ b/rwkv7-2.9B-g1-iq3_xxs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ff4d56372a6c6838bd3e06f9f7af503471468cc9ebd622a46ef6217e0f41258e +size 1466850112 diff --git a/rwkv7-2.9B-g1-iq4_nl.gguf b/rwkv7-2.9B-g1-iq4_nl.gguf new file mode 100644 index 0000000..6bccf55 --- /dev/null +++ b/rwkv7-2.9B-g1-iq4_nl.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f5a04a0a199f26456ec309cdd033497d7a9f7ce9df6f5fe6e5b48f180f8031d8 +size 1832540992 diff --git a/rwkv7-2.9B-g1-iq4_xs.gguf b/rwkv7-2.9B-g1-iq4_xs.gguf new file mode 100644 index 0000000..fe0c7c4 --- /dev/null +++ b/rwkv7-2.9B-g1-iq4_xs.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c2b66d389dcedfe81f33e13d6f49654f543f914b629f786deb2eca7f889d37b2 +size 1840405312 diff --git a/rwkv7-2.9B-g1-q3_k_m.gguf b/rwkv7-2.9B-g1-q3_k_m.gguf new file mode 100644 index 0000000..da102a7 --- /dev/null +++ b/rwkv7-2.9B-g1-q3_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:07017e2ec281937a98ac6bfae2246dea905de6bb6a6084f880dbdb52d880677d +size 1584814912 diff --git a/rwkv7-2.9B-g1-q3_k_s.gguf b/rwkv7-2.9B-g1-q3_k_s.gguf new file mode 100644 index 0000000..5dd930a --- /dev/null +++ b/rwkv7-2.9B-g1-q3_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f17dc3d3e06da6e192999dbc8c222067d58a0827d7313805843486179568797c +size 1540250432 diff --git a/rwkv7-2.9B-g1-q4_0.gguf b/rwkv7-2.9B-g1-q4_0.gguf new file mode 100644 index 0000000..324dfe0 --- /dev/null +++ b/rwkv7-2.9B-g1-q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b09b3750f6469ae4dcf82897a2eeea14410dd000c2b4386cb535ef2e234a501f +size 2000313152 diff --git a/rwkv7-2.9B-g1-q4_1.gguf b/rwkv7-2.9B-g1-q4_1.gguf new file mode 100644 index 0000000..a6f4e31 --- /dev/null +++ b/rwkv7-2.9B-g1-q4_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:84b9675530207c4af9b0aa67a28b2fc7331e116345b71ce2ee31f817acaa9eb1 +size 2031770432 diff --git a/rwkv7-2.9B-g1-q4_k_m.gguf b/rwkv7-2.9B-g1-q4_k_m.gguf new file mode 100644 index 0000000..3135f8c --- /dev/null +++ b/rwkv7-2.9B-g1-q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6b97262957cb98c285dea9dca581dab92d92f0e9e30f071ee78acf2670fcbb12 +size 2000313152 diff --git a/rwkv7-2.9B-g1-q4_k_s.gguf b/rwkv7-2.9B-g1-q4_k_s.gguf new file mode 100644 index 0000000..305de49 --- /dev/null +++ b/rwkv7-2.9B-g1-q4_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6c1df451accfcbc4cd000a96e438fd93eba3342c347761b8a465e90fd2dccd01 +size 1919048512 diff --git a/rwkv7-2.9B-g1-q5_0.gguf b/rwkv7-2.9B-g1-q5_0.gguf new file mode 100644 index 0000000..61cd882 --- /dev/null +++ b/rwkv7-2.9B-g1-q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:088a92e80ae689cec0cac3fdc09a0bfd0feb031acfd0ad5f12e1e8101c88d034 +size 2314885952 diff --git a/rwkv7-2.9B-g1-q5_1.gguf b/rwkv7-2.9B-g1-q5_1.gguf new file mode 100644 index 0000000..77514f5 --- /dev/null +++ b/rwkv7-2.9B-g1-q5_1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e64aefcb6c37d5e112b3290a470810f43bd46f9194fee460f805aca385d2ad87 +size 2472172352 diff --git a/rwkv7-2.9B-g1-q5_k_m.gguf b/rwkv7-2.9B-g1-q5_k_m.gguf new file mode 100644 index 0000000..22baa1e --- /dev/null +++ b/rwkv7-2.9B-g1-q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:49f355539b67f05a95bc9c4bbed48aa9bc1ebfffd4dc9dc75dbc697c4beb97e7 +size 2314885952 diff --git a/rwkv7-2.9B-g1-q5_k_s.gguf b/rwkv7-2.9B-g1-q5_k_s.gguf new file mode 100644 index 0000000..0144b56 --- /dev/null +++ b/rwkv7-2.9B-g1-q5_k_s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:93fdee6bb185a2e6c0f9b06f0d66911279c0c063599214c2782354c2e22d69aa +size 2233620640 diff --git a/rwkv7-2.9B-g1-q6_k_m.gguf b/rwkv7-2.9B-g1-q6_k_m.gguf new file mode 100644 index 0000000..58a3c37 --- /dev/null +++ b/rwkv7-2.9B-g1-q6_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e8de508f00401d890b690d318dc9f1db90bd1bb234e9a54b35533d3c3cc63893 +size 2649119552 diff --git a/rwkv7-2.9B-g1-q8_0.gguf b/rwkv7-2.9B-g1-q8_0.gguf new file mode 100644 index 0000000..7addc41 --- /dev/null +++ b/rwkv7-2.9B-g1-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6c74d395425069c4b0357bc7de7e51dec6a26f61157f3c8c1fd57d8ad6670427 +size 3258604032 diff --git a/rwkv7-2.9B-g1.imatrix b/rwkv7-2.9B-g1.imatrix new file mode 100644 index 0000000..c036e6b --- /dev/null +++ b/rwkv7-2.9B-g1.imatrix @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1ce8dc79c3a0704e9151e0d08faacd4095a8f619d3fb9355298aeff36f8334ce +size 4340350