初始化项目,由ModelHub XC社区提供模型

Model: evilfreelancer/ruGPT3XL-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-28 19:23:22 +08:00
commit ed30002a21
12 changed files with 209 additions and 0 deletions

39
.gitattributes vendored Normal file
View File

@@ -0,0 +1,39 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
ruGPT3XL-f16.gguf filter=lfs diff=lfs merge=lfs -text
ruGPT3XL-q4_0.gguf filter=lfs diff=lfs merge=lfs -text
ruGPT3XL-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text
ruGPT3XL-q8_0.gguf filter=lfs diff=lfs merge=lfs -text

7
Modelfile.fp16 Normal file
View File

@@ -0,0 +1,7 @@
FROM "./ruGPT3XL-f16.gguf"
PARAMETER num_ctx 2048
PARAMETER temperature 0.8
PARAMETER top_p 0.95
PARAMETER repeat_penalty 1.1
TEMPLATE """{{ if .System }}{{ .System }}{{ end }}{{ if .Prompt }}{{ .Prompt }}{{ end }}"""

7
Modelfile.q4_0 Normal file
View File

@@ -0,0 +1,7 @@
FROM "./ruGPT3XL-q4_0.gguf"
PARAMETER num_ctx 2048
PARAMETER temperature 0.8
PARAMETER top_p 0.95
PARAMETER repeat_penalty 1.1
TEMPLATE """{{ if .System }}{{ .System }}{{ end }}{{ if .Prompt }}{{ .Prompt }}{{ end }}"""

7
Modelfile.q4_k_m Normal file
View File

@@ -0,0 +1,7 @@
FROM "./ruGPT3XL-q4_k_m.gguf"
PARAMETER num_ctx 2048
PARAMETER temperature 0.8
PARAMETER top_p 0.95
PARAMETER repeat_penalty 1.1
TEMPLATE """{{ if .System }}{{ .System }}{{ end }}{{ if .Prompt }}{{ .Prompt }}{{ end }}"""

7
Modelfile.q8_0 Normal file
View File

@@ -0,0 +1,7 @@
FROM "./ruGPT3XL-q8_0.gguf"
PARAMETER num_ctx 2048
PARAMETER temperature 0.8
PARAMETER top_p 0.95
PARAMETER repeat_penalty 1.1
TEMPLATE """{{ if .System }}{{ .System }}{{ end }}{{ if .Prompt }}{{ .Prompt }}{{ end }}"""

114
README.md Normal file
View File

@@ -0,0 +1,114 @@
---
language:
- ru
library_name: transformers
tags:
- text-generation
- gpt3
- russian
- causal-lm
license: mit
pipeline_tag: text-generation
base_model: evilfreelancer/ruGPT3XL
---
# ruGPT-3 XL (HuggingFace format) GGUF
A 1.3B-parameter GPT-3-style language model for Russian, converted from the original
[ai-forever/rugpt3xl](https://huggingface.co/ai-forever/rugpt3xl) Megatron-LM checkpoint
into a native HuggingFace `transformers` format.
This is a **base (pretrained) model**, not instruction-tuned. It performs text completion
and can be fine-tuned for downstream tasks.
Details in "[A family of pretrained transformer language models for Russian](https://scholar.google.com/citations?view_op=view_citation&hl=en&user=yPayeJIAAAAJ&citation_for_view=yPayeJIAAAAJ:Se3iqnhoufwC)" paper.
## Model Details
| Parameter | Value |
|---|---|
| Parameters | 1.3B |
| Architecture | GPT-3 (decoder-only transformer) |
| Hidden size | 2048 |
| Layers | 24 |
| Attention heads | 16 |
| FFN intermediate size | 8192 |
| Max sequence length | 2048 |
| Vocabulary | 50,264 tokens (BPE) |
| Activation | GELU |
| Normalization | Pre-LayerNorm |
| Position encoding | Learned absolute |
| Precision | float16 |
| Training data | 80B tokens of Russian text (4 epochs) |
| Test perplexity | 12.05 |
## Quick Start
Example with Q4_K_M:
```bash
./llama.cpp/build/bin/llama-cli \
-m ./ruGPT3XL-GGUF/ruGPT3XL-q4_k_m.gguf \
-c 2048 \
-p "Москва - столица" \
-n 128 \
--temp 0.7 \
--top-p 0.9 \
--repeat-penalty 1.2
```
Notes:
- Use `-c 2048` for the native context length.
- Prefer `ruGPT3XL-q4_k_m.gguf` or `ruGPT3XL-q8_0.gguf` for CPU inference.
- Use `ruGPT3XL-f16.gguf` mainly for GPU.
Start server:
```bash
./llama.cpp/build/bin/llama-server \
-m ./ruGPT3XL-GGUF/ruGPT3XL-q4_k_m.gguf \
-c 2048 \
--host 127.0.0.1 \
--port 8080
```
Example request:
```bash
curl http://127.0.0.1:8080/completion \
-H "Content-Type: application/json" \
-d '{
"prompt": "Вопрос: Какая столица России?\n\nОтвет: ",
"n_predict": 128,
"temperature": 0.7,
"top_p": 0.9,
"repeat_penalty": 1.2
}'
```
## Limitations
- This is a **base model** trained on Russian internet text. It may generate biased, factually
incorrect, or offensive content.
- The model was trained primarily on Russian text. It has limited capability in other languages.
- Maximum context length is 2048 tokens. Inputs longer than this will be truncated.
- The model is not instruction-tuned and works best for text completion rather than
following specific instructions.
## Citation
```bibtex
@misc{rugpt3xl-gguf,
title={ruGPT3XL-GGUF},
author={Pavel Rykov},
year={2026},
publisher={Hugging Face},
url={https://huggingface.co/evilfreelancer/ruGPT3XL-GGUF}
}
```
## Links
- [A family of pretrained transformer language models for Russian](https://scholar.google.com/citations?view_op=view_citation&hl=en&user=yPayeJIAAAAJ&citation_for_view=yPayeJIAAAAJ:Se3iqnhoufwC) - paper on Google Scholar
- [ai-forever/rugpt3xl](https://huggingface.co/ai-forever/rugpt3xl) - original model
- [ai-forever/ru-gpts](https://github.com/ai-forever/ru-gpts) - original training codebase

9
ollama-create-all.sh Normal file
View File

@@ -0,0 +1,9 @@
#!/usr/bin/env bash
set -euo pipefail
cd "$(dirname "$0")"
ollama create evilfreelancer/rugpt3:3xl-fp16 -f Modelfile.fp16
ollama create evilfreelancer/rugpt3:3xl-q8_0 -f Modelfile.q8_0
ollama create evilfreelancer/rugpt3:3xl-q4_0 -f Modelfile.q4_0
ollama create evilfreelancer/rugpt3:3xl-q4_k_m -f Modelfile.q4_k_m

7
ollama-push-all.sh Normal file
View File

@@ -0,0 +1,7 @@
#!/usr/bin/env bash
set -euo pipefail
ollama push evilfreelancer/rugpt3:3xl-fp16
ollama push evilfreelancer/rugpt3:3xl-q8_0
ollama push evilfreelancer/rugpt3:3xl-q4_0
ollama push evilfreelancer/rugpt3:3xl-q4_k_m

3
ruGPT3XL-f16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:49a9733030d3993768ed5024ba784e42f5e417beea599339071955e37ea2aaf9
size 2850364608

3
ruGPT3XL-q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f7aafa15e9aa598e4a9af6811ed97d5ba6e245327e5fb555c4a71378bd25dee9
size 844507712

3
ruGPT3XL-q4_k_m.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9cc00819ac781104b878b99e9ddbafb64f521baf22e919fe2399d07b06d851bf
size 935340608

3
ruGPT3XL-q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:be995f06c665ce85b64acfacd265b6373ba7c29d9c28106f49fd3433a01654ec
size 1524888768