初始化项目,由ModelHub XC社区提供模型

Model: Mungert/rwkv7-2.9B-g1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-21 10:04:05 +08:00
commit 9952060fb9
26 changed files with 326 additions and 0 deletions

71
.gitattributes vendored Normal file
View File

@@ -0,0 +1,71 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bin.* filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zstandard filter=lfs diff=lfs merge=lfs -text
*.tfevents* filter=lfs diff=lfs merge=lfs -text
*.db* filter=lfs diff=lfs merge=lfs -text
*.ark* filter=lfs diff=lfs merge=lfs -text
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ggml filter=lfs diff=lfs merge=lfs -text
*.llamafile* filter=lfs diff=lfs merge=lfs -text
*.pt2 filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq3_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-f16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq3_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-bf16.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q3_k_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq4_xs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq4_nl.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q4_1.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q4_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq3_xs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q4_k_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-imatrix.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-bf16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-iq3_xxs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1.imatrix filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q5_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q5_1.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q6_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-2.9B-g1-q5_k_s.gguf filter=lfs diff=lfs merge=lfs -text

185
README.md Normal file
View File

@@ -0,0 +1,185 @@
---
license: apache-2.0
language:
- en
- zh
- ja
- ko
- fr
- ar
- es
- pt
metrics:
- accuracy
base_model:
- BlinkDL/rwkv7-g1
pipeline_tag: text-generation
---
# <span style="color: #7FFF7F;">rwkv7-2.9B-g1 GGUF Models</span>
## <span style="color: #7F7FFF;">Model Generation Details</span>
This model was generated using [llama.cpp](https://github.com/ggerganov/llama.cpp) at commit [`4807e8f9`](https://github.com/ggerganov/llama.cpp/commit/4807e8f96a61b2adccebd5e57444c94d18de7264).
---
<a href="https://readyforquantum.com/huggingface_gguf_selection_guide.html" style="color: #7FFF7F;">
Click here to get info on choosing the right GGUF model format
</a>
---
<!--Begin Original Model Card-->
# rwkv7-2.9B-g1
<!-- Provide a quick summary of what the model is/does. -->
This is RWKV-7 model under flash-linear attention format.
## Model Details
### Model Description
<!-- Provide a longer summary of what this model is. -->
- **Developed by:** Bo Peng, Yu Zhang, Songlin Yang, Ruichong Zhang, Zhiyuan Li
- **Funded by:** RWKV Project (Under LF AI & Data Foundation)
- **Model type:** RWKV7
- **Language(s) (NLP):** Multilingual
- **License:** Apache-2.0
- **Parameter count:** 2.9B
- **Tokenizer:** RWKV World tokenizer
- **Vocabulary size:** 65,536
### Model Sources
<!-- Provide the basic links for the model. -->
- **Repository:** https://github.com/fla-org/flash-linear-attention ; https://github.com/BlinkDL/RWKV-LM
- **Paper:** https://arxiv.org/abs/2503.14456
- **Model:** https://huggingface.co/BlinkDL/rwkv7-g1/resolve/main/rwkv7-g1-2.9b-20250519-ctx4096.pth
## Uses
<!-- Address questions around how the model is intended to be used, including the foreseeable users of the model and those affected by the model. -->
Install `flash-linear-attention` and the latest version of `transformers` before using this model:
```bash
pip install git+https://github.com/fla-org/flash-linear-attention
pip install 'transformers>=4.48.0'
```
### Direct Use
<!-- This section is for the model use without fine-tuning or plugging into a larger ecosystem/app. -->
You can use this model just as any other HuggingFace models:
```python
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained('fla-hub/rwkv7-2.9B-g1', trust_remote_code=True)
tokenizer = AutoTokenizer.from_pretrained('fla-hub/rwkv7-2.9B-g1', trust_remote_code=True)
model = model.cuda() # Supported on Nvidia/AMD/Intel eg. model.xpu()
prompt = "What is a large language model?"
messages = [
{"role": "user", "content": prompt}
]
text = tokenizer.apply_chat_template(
messages,
tokenize=False,
add_generation_prompt=True,
enable_thinking=True # Default is True, set to False to disable thinking
)
model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
generated_ids = model.generate(
**model_inputs,
max_new_tokens=1024,
do_sample=True,
temperature=1.0,
top_p=0.3,
repetition_penalty=1.2
)
generated_ids = [
output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids)
]
response = tokenizer.batch_decode(generated_ids, skip_special_tokens=False)[0]
print(response)
```
## FAQ
Q: safetensors metadata is none.
A: upgrade transformers to >=4.48.0: `pip install 'transformers>=4.48.0'`
<!--End Original Model Card-->
---
# <span id="testllm" style="color: #7F7FFF;">🚀 If you find these models useful</span>
Help me test my **AI-Powered Quantum Network Monitor Assistant** with **quantum-ready security checks**:
👉 [Quantum Network Monitor](https://readyforquantum.com/?assistant=open&utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme)
The full Open Source Code for the Quantum Network Monitor Service available at my github repos ( repos with NetworkMonitor in the name) : [Source Code Quantum Network Monitor](https://github.com/Mungert69). You will also find the code I use to quantize the models if you want to do it yourself [GGUFModelBuilder](https://github.com/Mungert69/GGUFModelBuilder)
💬 **How to test**:
Choose an **AI assistant type**:
- `TurboLLM` (GPT-4.1-mini)
- `HugLLM` (Hugginface Open-source models)
- `TestLLM` (Experimental CPU-only)
### **What Im Testing**
Im pushing the limits of **small open-source models for AI network monitoring**, specifically:
- **Function calling** against live network services
- **How small can a model go** while still handling:
- Automated **Nmap security scans**
- **Quantum-readiness checks**
- **Network Monitoring tasks**
🟡 **TestLLM** Current experimental model (llama.cpp on 2 CPU threads on huggingface docker space):
-**Zero-configuration setup**
- ⏳ 30s load time (slow inference but **no API costs**) . No token limited as the cost is low.
- 🔧 **Help wanted!** If youre into **edge-device AI**, lets collaborate!
### **Other Assistants**
🟢 **TurboLLM** Uses **gpt-4.1-mini** :
- **It performs very well but unfortunatly OpenAI charges per token. For this reason tokens usage is limited.
- **Create custom cmd processors to run .net code on Quantum Network Monitor Agents**
- **Real-time network diagnostics and monitoring**
- **Security Audits**
- **Penetration testing** (Nmap/Metasploit)
🔵 **HugLLM** Latest Open-source models:
- 🌐 Runs on Hugging Face Inference API. Performs pretty well using the lastest models hosted on Novita.
### 💡 **Example commands you could test**:
1. `"Give me info on my websites SSL certificate"`
2. `"Check if my server is using quantum safe encyption for communication"`
3. `"Run a comprehensive security audit on my server"`
4. '"Create a cmd processor to .. (what ever you want)" Note you need to install a [Quantum Network Monitor Agent](https://readyforquantum.com/Download/?utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) to run the .net code on. This is a very flexible and powerful feature. Use with caution!
### Final Word
I fund the servers used to create these model files, run the Quantum Network Monitor service, and pay for inference from Novita and OpenAI—all out of my own pocket. All the code behind the model creation and the Quantum Network Monitor project is [open source](https://github.com/Mungert69). Feel free to use whatever you find helpful.
If you appreciate the work, please consider [buying me a coffee](https://www.buymeacoffee.com/mahadeva) ☕. Your support helps cover service costs and allows me to raise token limits for everyone.
I'm also open to job opportunities or sponsorship.
Thank you! 😊

1
configuration.json Normal file
View File

@@ -0,0 +1 @@
{"framework": "pytorch", "task": "text-generation", "allow_remote": true}

3
rwkv7-2.9B-g1-bf16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9bdbea6da1000a57dc7e0c29811c22370dab340de8b0d64f01a55abef6dbd560
size 5932472832

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:06bba3e9bd52ca4c1192c3dee56d379b33475ed0bc768aadd61e35f63a0ee0c0
size 3573176160

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:966e51a285b33fbc53010f68f341085316deeccaf9eed1ed9551823c2f6d6e09
size 3573176832

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0ee26a8244217c63a5974d716417fffc9b15c94fc03967f68be5e58fdf50a8a7
size 4396544

3
rwkv7-2.9B-g1-iq3_m.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:30c53a526800eaab2f86849560863f7b3588e4d2a9eb2e434d89a2133005b720
size 1584814912

3
rwkv7-2.9B-g1-iq3_s.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d89aef706f00b9622e5caf7dcbbb721b6dd29910828399637fb12b9e8129f185
size 1540249760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:10c43ea85217cfa27ad2a90cfdea88e4e1a6f90f3e04e4509d43fccbdfe77232
size 1584814912

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ff4d56372a6c6838bd3e06f9f7af503471468cc9ebd622a46ef6217e0f41258e
size 1466850112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f5a04a0a199f26456ec309cdd033497d7a9f7ce9df6f5fe6e5b48f180f8031d8
size 1832540992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:c2b66d389dcedfe81f33e13d6f49654f543f914b629f786deb2eca7f889d37b2
size 1840405312

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:07017e2ec281937a98ac6bfae2246dea905de6bb6a6084f880dbdb52d880677d
size 1584814912

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f17dc3d3e06da6e192999dbc8c222067d58a0827d7313805843486179568797c
size 1540250432

3
rwkv7-2.9B-g1-q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b09b3750f6469ae4dcf82897a2eeea14410dd000c2b4386cb535ef2e234a501f
size 2000313152

3
rwkv7-2.9B-g1-q4_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:84b9675530207c4af9b0aa67a28b2fc7331e116345b71ce2ee31f817acaa9eb1
size 2031770432

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6b97262957cb98c285dea9dca581dab92d92f0e9e30f071ee78acf2670fcbb12
size 2000313152

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6c1df451accfcbc4cd000a96e438fd93eba3342c347761b8a465e90fd2dccd01
size 1919048512

3
rwkv7-2.9B-g1-q5_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:088a92e80ae689cec0cac3fdc09a0bfd0feb031acfd0ad5f12e1e8101c88d034
size 2314885952

3
rwkv7-2.9B-g1-q5_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e64aefcb6c37d5e112b3290a470810f43bd46f9194fee460f805aca385d2ad87
size 2472172352

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:49f355539b67f05a95bc9c4bbed48aa9bc1ebfffd4dc9dc75dbc697c4beb97e7
size 2314885952

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:93fdee6bb185a2e6c0f9b06f0d66911279c0c063599214c2782354c2e22d69aa
size 2233620640

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e8de508f00401d890b690d318dc9f1db90bd1bb234e9a54b35533d3c3cc63893
size 2649119552

3
rwkv7-2.9B-g1-q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6c74d395425069c4b0357bc7de7e51dec6a26f61157f3c8c1fd57d8ad6670427
size 3258604032

3
rwkv7-2.9B-g1.imatrix Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1ce8dc79c3a0704e9151e0d08faacd4095a8f619d3fb9355298aeff36f8334ce
size 4340350