初始化项目,由ModelHub XC社区提供模型

Model: RefalMachine/RuadaptQwen2.5-7B-Lite-Beta-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-08 11:56:09 +08:00
commit 8a6ee12c51
11 changed files with 138 additions and 0 deletions

44
.gitattributes vendored Normal file
View File

@@ -0,0 +1,44 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
FP16.gguf filter=lfs diff=lfs merge=lfs -text
Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Q8_0.gguf filter=lfs diff=lfs merge=lfs -text

3
FP16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:bdb0a575dc6ef9d58cbd2cb92138205c452c3a14b7dc4bb5246249e4ab8c79dd
size 15139868192

3
Q2_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6cf95cd6d0ca10a55e269240e5f2c24882c66d37a38fd2b5cefe875f044a4a4a
size 2988595744

3
Q3_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:12c756cd1b5a8b3f28aa31edb6bd0d2b1eb2ca140fa95ae9f7fc331adb9e0e52
size 3778530848

3
Q4_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a314746155175858d5d527ae4f4cb7823b7f8b26ed17d10444bf0a58568abbfc
size 4398240288

3
Q4_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5a172a3be62b48b76d48e3516f6474a08da6e4f3e6d3a280f8337f48e31254d8
size 4649923104

3
Q5_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1f0795345c0caaa70f279ae9128bc1d71371241015ff8c8e566ab5edf7134c7a
size 5278929440

3
Q5_K_M.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:02dd6c5a2202c1a96dabf0ec7b14929e19d0f7b0de1f41428bcd60017cdbed0d
size 5408584224

3
Q6_K.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1ea247047f540e8dca89ef91bba014f5facbd69c7f845827e4c054a2f702b3a9
size 6214661664

3
Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fbe5b7f689bed824e3f240b9b45719adb363436f0a2f33e88287f48025ee3dab
size 8046988832

67
README.md Normal file
View File

@@ -0,0 +1,67 @@
---
datasets:
- IlyaGusev/saiga_scored
- IlyaGusev/saiga_preferences
- dichspace/darulm
language:
- ru
pipeline_tag: text-generation
license: apache-2.0
base_model:
- Qwen/Qwen2.5-7B
- t-tech/T-lite-it-1.0
---
## Описание модели
GGUF версия! WORK IN PROGRESS!!! Текущая версия v1.
Адаптация модели T-lite-it-1.0 на русский язык. В модели был заменен токенизатор, затем произведено дообучение (Continued pretraining) на русскоязычном корпусе, после чего была применена техника LEP (Learned Embedding Propagation).
Благодаря новому токенизатору (расширенный tiktoken cl100k с помощью униграм токенизатора на 48 т. токенов) скорость генерации* русскоязычных текстов возрасла до 60% по сравнению с исходной моделью T-lite-it-1.0.
*Под скоростью генерации подразумевается количество русскоязычных символов/слов в секунду на одинаковых текстовых последовательностях.
## Попробовать
Модель можно попробовать в поднятом Space (внизу в параметрах выбор модели):
https://huggingface.co/spaces/RefalMachine/RuadaptQwen2.5
## Токенизация
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/O4eQEhnowETEatDPcmArB.png)
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/oW0Q6LzD_Py3GdH0kfqu4.png)
## Метрики и оценка качества
Модель была оценена на Ru-Arena-General, MERA, llmtf_open
#### Результаты на Ru-Arena-General
Замеры были произведены с использованием оффициального кода лидерборда (https://github.com/VikhrModels/ru_llm_arena), **но с repetition_penalty=1.1**.
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/iwSdS1MYds3ws_zFmrbku.png)
#### Результаты на Shlepa
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/NqtNA9DQlMkBGyyKlG9JG.png)
#### Результаты на MERA
![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/tE4K4hHpS31-xRx0J7cxR.png)
#### Результаты на llmtf_open
TODO
## How to cite:
Tikhomirov M., Chernyshov D. Facilitating Large Language Model Russian Adaptation with Learned Embedding Propagation //Journal of Language and Education. 2024. Т. 10. №. 4. С. 130-145.
Tikhomirov M., Chernyshev D. Impact of Tokenization on LLaMa Russian Adaptation //2023 Ivannikov Ispras Open Conference (ISPRAS). IEEE, 2023. С. 163-168.
## Предупреждение
Ответы модели не отражают мнения авторов, а лишь повторяют знания полученные из данных на всех этапах обучения (предобучение, смена токенизатора, обучение на инструкциях, калибровка качества ответов). Модель была получена из сторонней предобученной модели, **контроль за предобучением** которой **не является ответственностью текущих авторов**. При создании данной версии модели не производилось никаких дополнительных действий, направленных на изменение заложенных в LLM "мнений". Используйте с осторожностью.