初始化项目,由ModelHub XC社区提供模型

Model: RefalMachine/RuadaptQwen2.5-14B-R1-distill-preview-v1-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-20 01:04:11 +08:00
commit af73268c8d
18 changed files with 163 additions and 0 deletions

51
.gitattributes vendored Normal file
View File

@@ -0,0 +1,51 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
FP16.gguf filter=lfs diff=lfs merge=lfs -text
IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Q8_0.gguf filter=lfs diff=lfs merge=lfs -text

3
FP16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ff73df13e7d3171ca929a03d67304f7a210a3f69b71c71f1a29aeb3b2e3be4f0
size 29407407072

3
IQ3_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5a9b5aff8da8e035a3cb2f730ee493144844b3d2d6e6c27763e5b14d264120be
size 6649932544

3
IQ3_XS.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:be7158c59a5285165c4aea4cab5160035d3e03da17edbec1acf4aad6bf284ad8
size 6340274944

3
IQ4_NL.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4c2666c21773f9196e7ededc37ce472253e43a4af909a18771441242673119de
size 8554485120

3
IQ4_XS.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:396ee5edade33b9784097e038b55b325bc88f4e11cb6a0673eac7401fe34cdef
size 8139518240

3
Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:230418253d8733b5036dfc8cc80883ae00ee0db0eb5894c6fe597416d825ff3d
size 5731001536

3
Q3_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ca88425ce0e8906aca5f03e19c25131bdef579c86960878220be98d561af8f12
size 7296117504

3
Q3_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:39e382086d3e36f080e0ecede34efea174663c2a6a8849eba61bf694ac401afb
size 6616509184

3
Q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:361337be2ba721e50fc0d8c0075b14ace49d34d2941afb541cd1fb711c6c9709
size 8469943680

3
Q4_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fcf289f5f8344cd8704c1054e5e713fd08cf3722c8c4913c8af3eb5161973824
size 8940328320

3
Q4_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:40c365951fc0e3ffec8613a21691b3f9aabb883fd4f4fa80ca44c6dfb8366595
size 8525649280

3
Q5_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ad7bda8dfe12d7972c53821d6be6f91174f9377d07593c2fcffdbd317bbb0e94
size 10214352640

3
Q5_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:55b440c4e6a5af0765e1ec8abf4b2f3e8ad6e9d16e609cacb302bfdf8d112e30
size 10456672000

3
Q5_K_S.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9c28eb723a9bda784fb7bfdab893fa9ed121a64ef41665ca6e11378c46fcb890
size 10214352640

3
Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4dc5c1ec6b25b5e85d9e301c46086696c9f5ba23aaf3f8d9994a39ca9cfb1e47
size 12067787168

3
Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:21c1c7b159b8bacfc83e722a9daf81f8a28bd34adbee2ae5c58b44380d5053d9
size 15627576672

64
README.md Normal file
View File

@@ -0,0 +1,64 @@
---
datasets:
- kristaller486/Nebo-T1-Russian
- Egor-AI/CoT-XLang
- dichspace/darulm
language:
- ru
pipeline_tag: text-generation
license: apache-2.0
---
## Описание модели
WORK IN PROGRESS!!! Текущая версия v1.
Инструктивная версия адаптированной на русский язык модели deepseek-ai/DeepSeek-R1-Distill-Qwen-14B. В модели был заменен токенизатор, затем произведено дообучение (Continued pretraining) на русскоязычном корпусе, после чего была применена техника LEP (Learned Embedding Propagation).
Благодаря новому токенизатору (расширенный tiktoken cl100k с помощью униграм токенизатора на 48 т. токенов) скорость генерации* русскоязычных текстов возрасла до 60% по сравнению с исходной моделью deepseek-ai/DeepSeek-R1-Distill-Qwen-14B.
*Под скоростью генерации подразумевается количество русскоязычных символов/слов в секунду на одинаковых текстовых последовательностях.
## Попробовать
Модель можно попробовать в поднятом Space (внизу в параметрах выбор модели):
https://huggingface.co/spaces/RefalMachine/RuadaptQwen2.5
## Токенизация
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/O4eQEhnowETEatDPcmArB.png)
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/oW0Q6LzD_Py3GdH0kfqu4.png)
## Метрики и оценка качества
Модель была оценена на Ru-Arena-General, MERA, llmtf_open
#### Результаты на Ru-Arena-General
Замеры были произведены с использованием оффициального кода лидерборда (https://github.com/VikhrModels/ru_llm_arena), **но с repetition_penalty=1.1**.
TODO
#### Результаты на MERA
Для сабмита на MERA был подготовлен кастомный системный промпт, который смягчает недостатки оценки на кодовых задачах. Для сравнения был также сделан сабмит с этим же системным промптом оригинальной модели.
TODO
#### Результаты на llmtf_open
TODO
## How to cite:
Tikhomirov M., Chernyshev D. Facilitating large language model Russian adaptation with Learned Embedding Propagation // 2024 (Preprint: https://arxiv.org/abs/2412.21140)
Tikhomirov M., Chernyshev D. Impact of Tokenization on LLaMa Russian Adaptation //2023 Ivannikov Ispras Open Conference (ISPRAS). IEEE, 2023. С. 163-168.
## Предупреждение
Ответы модели не отражают мнения авторов, а лишь повторяют знания полученные из данных на всех этапах обучения (предобучение, смена токенизатора, обучение на инструкциях, калибровка качества ответов). Модель была получена из сторонней предобученной модели, **контроль за предобучением** которой **не является ответственностью текущих авторов**. При создании данной версии модели не производилось никаких дополнительных действий, направленных на изменение заложенных в LLM "мнений". Используйте с осторожностью.