初始化项目,由ModelHub XC社区提供模型

Model: Mungert/rwkv7-0.1B-g1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-11 14:15:16 +08:00
commit 8179d8b782
24 changed files with 361 additions and 0 deletions

70
.gitattributes vendored Normal file
View File

@@ -0,0 +1,70 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-f16.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-f16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-bf16_q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-f16_q6_k.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-bf16_q6_k.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-f16_q4_k.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-bf16_q4_k.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q3_k_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_k_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_k_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q6_k_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q3_k_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_k_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_k_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q6_k_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q8_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_1.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_0_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q4_1_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_0.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_1.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_0_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-q5_1_l.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq3_xs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq3_xxs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq3_s.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq3_m.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq4_xs.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-iq4_nl.gguf filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1.imatrix filter=lfs diff=lfs merge=lfs -text
rwkv7-0.1B-g1-bf16.gguf filter=lfs diff=lfs merge=lfs -text

225
README.md Normal file
View File

@@ -0,0 +1,225 @@
---
base_model:
- BlinkDL/rwkv7-g1
language:
- en
- zh
- ja
- ko
- fr
- ar
- es
- pt
license: apache-2.0
metrics:
- accuracy
pipeline_tag: text-generation
library_name: transformers
---
# <span style="color: #7FFF7F;">rwkv7-0.1B-g1 GGUF Models</span>
## <span style="color: #7F7FFF;">Model Generation Details</span>
This model was generated using [llama.cpp](https://github.com/ggerganov/llama.cpp) at commit [`e4868d16`](https://github.com/ggerganov/llama.cpp/commit/e4868d16d24dec55e61bcaadaca28feed8f98b13).
---
<a href="https://readyforquantum.com/huggingface_gguf_selection_guide.html" style="color: #7FFF7F;">
Click here to get info on choosing the right GGUF model format
</a>
---
<!--Begin Original Model Card-->
# rwkv7-0.1B-g1
<!-- Provide a quick summary of what the model is/does. -->
This is RWKV-7 g1 model under flash-linear attention format. The `g1` model series added significant more data and incorporated deep thinking abilities.
## Model Details
### Model Description
<!-- Provide a longer summary of what this model is. -->
- **Developed by:** Bo Peng, Yu Zhang, Songlin Yang, Ruichong Zhang
- **Funded by:** RWKV Project (Under LF AI & Data Foundation)
- **Model type:** RWKV7
- **Language(s) (NLP):** Multilingal
- **License:** Apache-2.0
- **Parameter count:** 191M
- **Tokenizer:** RWKV World tokenizer
- **Vocabulary size:** 65,536
### Model Sources
<!-- Provide the basic links for the model. -->
- **Repository:** https://github.com/fla-org/flash-linear-attention ; https://github.com/BlinkDL/RWKV-LM
- **Paper:** https://arxiv.org/abs/2503.14456
## Uses
<!-- Address questions around how the model is intended to be used, including the foreseeable users of the model and those affected by the model. -->
Install `flash-linear-attention` and the latest version of `transformers` before using this model:
```bash
pip install git+https://github.com/fla-org/flash-linear-attention
pip install 'transformers>=4.48.0'
```
### Direct Use
<!-- This section is for the model use without fine-tuning or plugging into a larger ecosystem/app. -->
You can use this model just as any other HuggingFace models:
```python
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained('fla-hub/rwkv7-0.1B-g1', trust_remote_code=True)
tokenizer = AutoTokenizer.from_pretrained('fla-hub/rwkv7-0.1B-g1', trust_remote_code=True)
model = model.cuda() # Supported on Nvidia/AMD/Intel eg. model.xpu()
prompt = "What is a large language model?"
messages = [
{"role": "user", "content": prompt}
]
text = tokenizer.apply_chat_template(
messages,
tokenize=False,
add_generation_prompt=True,
enable_thinking=True # Default is True, set to False to disable thinking
)
model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
generated_ids = model.generate(
**model_inputs,
max_new_tokens=1024,
do_sample=True,
temperature=1.0,
top_p=0.3,
repetition_penalty=1.2
)
generated_ids = [
output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids)
]
response = tokenizer.batch_decode(generated_ids, skip_special_tokens=False)[0]
print(response)
```
### Training Data
This model is trained on the World v3.5 with a total of more than 5 trillion tokens.
## FAQ
Q: safetensors metadata is none.
A: upgrade transformers to >=4.48.0: `pip install 'transformers>=4.48.0'`
## Thinking Prompt
```
<|rwkv_tokenizer_end_of_text|>User: <Your Question Here>
Assistant: <think
```
Don't close the brackets for `<think`!
## Addidtional Caveats for Prompting
**Always add `<|rwkv_tokenizer_end_of_text|>` (Token ID = 0) before your prompt. The model is incapable of attending the first token it receives due to state initialization issues.**
Bad prompt example:
```
Mathews lifted a dark brow. "Are you sure about that? I mean, wouldn't it be better to wait until Dale is home safe and sound?"
"The longer I wait to tell her, the worse it will be for both of us."
"Good luck. You're going to need it," said
```
The model is unable to recall ` Mathews` because it is the very first token of the input.
Good prompt example:
```
<|rwkv_tokenizer_end_of_text|>Mathews lifted a dark brow. "Are you sure about that? I mean, wouldn't it be better to wait until Dale is home safe and sound?"
"The longer I wait to tell her, the worse it will be for both of us."
"Good luck. You're going to need it," said
```
the model will output ` Mathews` as expected.
Without this token: **`lambada_openai ppl=13.84 acc=48.13%`**
With this token added: **`lambada_openai ppl=12.36 acc=49.12%`**
Note: this phenomenon is very rare for Transformers but significant for RNNs. We speculate that the model uses the first token to pin the states, to better acquire information from later tokens.
<!--End Original Model Card-->
---
# <span id="testllm" style="color: #7F7FFF;">🚀 If you find these models useful</span>
Help me test my **AI-Powered Quantum Network Monitor Assistant** with **quantum-ready security checks**:
👉 [Quantum Network Monitor](https://readyforquantum.com/?assistant=open&utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme)
The full Open Source Code for the Quantum Network Monitor Service available at my github repos ( repos with NetworkMonitor in the name) : [Source Code Quantum Network Monitor](https://github.com/Mungert69). You will also find the code I use to quantize the models if you want to do it yourself [GGUFModelBuilder](https://github.com/Mungert69/GGUFModelBuilder)
💬 **How to test**:
Choose an **AI assistant type**:
- `TurboLLM` (GPT-4.1-mini)
- `HugLLM` (Hugginface Open-source models)
- `TestLLM` (Experimental CPU-only)
### **What Im Testing**
Im pushing the limits of **small open-source models for AI network monitoring**, specifically:
- **Function calling** against live network services
- **How small can a model go** while still handling:
- Automated **Nmap security scans**
- **Quantum-readiness checks**
- **Network Monitoring tasks**
🟡 **TestLLM** Current experimental model (llama.cpp on 2 CPU threads on huggingface docker space):
-**Zero-configuration setup**
- ⏳ 30s load time (slow inference but **no API costs**) . No token limited as the cost is low.
- 🔧 **Help wanted!** If youre into **edge-device AI**, lets collaborate!
### **Other Assistants**
🟢 **TurboLLM** Uses **gpt-4.1-mini** :
- **It performs very well but unfortunatly OpenAI charges per token. For this reason tokens usage is limited.
- **Create custom cmd processors to run .net code on Quantum Network Monitor Agents**
- **Real-time network diagnostics and monitoring**
- **Security Audits**
- **Penetration testing** (Nmap/Metasploit)
🔵 **HugLLM** Latest Open-source models:
- 🌐 Runs on Hugging Face Inference API. Performs pretty well using the lastest models hosted on Novita.
### 💡 **Example commands you could test**:
1. `"Give me info on my websites SSL certificate"`
2. `"Check if my server is using quantum safe encyption for communication"`
3. `"Run a comprehensive security audit on my server"`
4. '"Create a cmd processor to .. (what ever you want)" Note you need to install a [Quantum Network Monitor Agent](https://readyforquantum.com/Download/?utm_source=huggingface&utm_medium=referral&utm_campaign=huggingface_repo_readme) to run the .net code on. This is a very flexible and powerful feature. Use with caution!
### Final Word
I fund the servers used to create these model files, run the Quantum Network Monitor service, and pay for inference from Novita and OpenAI—all out of my own pocket. All the code behind the model creation and the Quantum Network Monitor project is [open source](https://github.com/Mungert69). Feel free to use whatever you find helpful.
If you appreciate the work, please consider [buying me a coffee](https://www.buymeacoffee.com/mahadeva) ☕. Your support helps cover service costs and allows me to raise token limits for everyone.
I'm also open to job opportunities or sponsorship.
Thank you! 😊

3
rwkv7-0.1B-g1-bf16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:36181e89172fdcb833b2e754e091403ff9b37175f966b323b18ad367ae6e29f0
size 386371008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:aefb5fc220088265a0fcfc71f90b210c5f7d568c6b3269317b07d2d71c5e7654
size 306744768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a52abe1f74b0ee36ceb64842ae25ed1d7d483e7563f9c82bc490819dd4239d0f
size 306744768

3
rwkv7-0.1B-g1-iq3_m.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:39b73c9e006473a5145886dd38329983e3afe462e367ebe2380d38344bb06e03
size 120876768

3
rwkv7-0.1B-g1-iq3_s.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:828a0d13a9e523930fe91732fa9a549a392e69035443b1345af934b357dab7ec
size 120876768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9920e65d4a33f284476c5da1a2d38be91851316ed2e960d8c65c5d369dc48aac
size 120876768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:25185b13f6524d28cc0376bc64ae7a39c9cda34a8ada60a53afd6f5efd7754c6
size 116895456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bf67fb1bdd87bc1cff00abcfc967f99cb8be4384c505ac7a319f12a9df5ee052
size 132550368

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4a18c57b2bc6c5b2006702fac69bcbc3db0a7cd217a4d80f28529ef461fb04ed
size 128323296

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:36b1885444a636e1e94f31738b7909a347bbad6635c763cee836a61aa88958cf
size 134246112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:051cb44fd93e39bb413eae36f81ed6cfb7ee90c462e76ca32ac20fba6c13e8ed
size 120876768

3
rwkv7-0.1B-g1-q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:08d5c465c307af890c489cc20ed245ace17581d3bdd8cfff0aec498d404198eb
size 119574240

3
rwkv7-0.1B-g1-q4_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:398e63a7ca505bcd12b88b49806edc852e075e770f3466b7458d984d806a151e
size 131174112

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e2ebeaae21c18956a1ea7c8c171d8baa315642d3d9cc2877fc9d058c4f23a3a6
size 145526496

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cec6e15534466991d08807116ef93a5ebe00903ffddb173bd96dc673f98e7909
size 145526496

3
rwkv7-0.1B-g1-q5_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:439bc5997e34fdbd4102dde663c66be47bd8b1146cd529de6bb69cb8bf47598a
size 142773984

3
rwkv7-0.1B-g1-q5_1.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f125457d8a67466ee6e26eb0fd205567839884a7f00a54672ed25847332b41f8
size 154373856

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d6ca28bd0a87e99659796d4c15c064cac7687e7341c5b4cb007f35dd45142be2
size 156143328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d2d6cf8b7bae34bbba6a4209af1ffbc61286c720e9a4afdee4e35cde77410a06
size 156143328

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:557487e13b777f7090fbee8a436229be49befac8bae95f296cae3ce5c65f31a3
size 167423712

3
rwkv7-0.1B-g1-q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b0403350b17df021ed73562897c1ea5c1095124595b23e1002610f1e856ab687
size 212372928

3
rwkv7-0.1B-g1.imatrix Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:441994cd900a3760f6e9906612d2ea431f56386b338888effa1ae5e0fbd368ae
size 496254