From af73268c8d7aa00fb6aa3ef6322524539d4b87cb Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Mon, 20 Jul 2026 01:04:11 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: RefalMachine/RuadaptQwen2.5-14B-R1-distill-preview-v1-GGUF Source: Original Platform --- .gitattributes | 51 ++++++++++++++++++++++++++++++++++++++++ FP16.gguf | 3 +++ IQ3_S.gguf | 3 +++ IQ3_XS.gguf | 3 +++ IQ4_NL.gguf | 3 +++ IQ4_XS.gguf | 3 +++ Q2_K.gguf | 3 +++ Q3_K_M.gguf | 3 +++ Q3_K_S.gguf | 3 +++ Q4_0.gguf | 3 +++ Q4_K_M.gguf | 3 +++ Q4_K_S.gguf | 3 +++ Q5_0.gguf | 3 +++ Q5_K_M.gguf | 3 +++ Q5_K_S.gguf | 3 +++ Q6_K.gguf | 3 +++ Q8_0.gguf | 3 +++ README.md | 64 ++++++++++++++++++++++++++++++++++++++++++++++++++ 18 files changed, 163 insertions(+) create mode 100644 .gitattributes create mode 100644 FP16.gguf create mode 100644 IQ3_S.gguf create mode 100644 IQ3_XS.gguf create mode 100644 IQ4_NL.gguf create mode 100644 IQ4_XS.gguf create mode 100644 Q2_K.gguf create mode 100644 Q3_K_M.gguf create mode 100644 Q3_K_S.gguf create mode 100644 Q4_0.gguf create mode 100644 Q4_K_M.gguf create mode 100644 Q4_K_S.gguf create mode 100644 Q5_0.gguf create mode 100644 Q5_K_M.gguf create mode 100644 Q5_K_S.gguf create mode 100644 Q6_K.gguf create mode 100644 Q8_0.gguf create mode 100644 README.md diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..139e973 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,51 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +FP16.gguf filter=lfs diff=lfs merge=lfs -text +IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text +IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text +IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text +IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Q5_0.gguf filter=lfs diff=lfs merge=lfs -text +Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Q8_0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/FP16.gguf b/FP16.gguf new file mode 100644 index 0000000..519c884 --- /dev/null +++ b/FP16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ff73df13e7d3171ca929a03d67304f7a210a3f69b71c71f1a29aeb3b2e3be4f0 +size 29407407072 diff --git a/IQ3_S.gguf b/IQ3_S.gguf new file mode 100644 index 0000000..f6060d2 --- /dev/null +++ b/IQ3_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5a9b5aff8da8e035a3cb2f730ee493144844b3d2d6e6c27763e5b14d264120be +size 6649932544 diff --git a/IQ3_XS.gguf b/IQ3_XS.gguf new file mode 100644 index 0000000..17d7260 --- /dev/null +++ b/IQ3_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:be7158c59a5285165c4aea4cab5160035d3e03da17edbec1acf4aad6bf284ad8 +size 6340274944 diff --git a/IQ4_NL.gguf b/IQ4_NL.gguf new file mode 100644 index 0000000..f735ef1 --- /dev/null +++ b/IQ4_NL.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4c2666c21773f9196e7ededc37ce472253e43a4af909a18771441242673119de +size 8554485120 diff --git a/IQ4_XS.gguf b/IQ4_XS.gguf new file mode 100644 index 0000000..84e502a --- /dev/null +++ b/IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:396ee5edade33b9784097e038b55b325bc88f4e11cb6a0673eac7401fe34cdef +size 8139518240 diff --git a/Q2_K.gguf b/Q2_K.gguf new file mode 100644 index 0000000..8f62be9 --- /dev/null +++ b/Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:230418253d8733b5036dfc8cc80883ae00ee0db0eb5894c6fe597416d825ff3d +size 5731001536 diff --git a/Q3_K_M.gguf b/Q3_K_M.gguf new file mode 100644 index 0000000..1d3de67 --- /dev/null +++ b/Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ca88425ce0e8906aca5f03e19c25131bdef579c86960878220be98d561af8f12 +size 7296117504 diff --git a/Q3_K_S.gguf b/Q3_K_S.gguf new file mode 100644 index 0000000..bf0c35b --- /dev/null +++ b/Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:39e382086d3e36f080e0ecede34efea174663c2a6a8849eba61bf694ac401afb +size 6616509184 diff --git a/Q4_0.gguf b/Q4_0.gguf new file mode 100644 index 0000000..d017fa2 --- /dev/null +++ b/Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:361337be2ba721e50fc0d8c0075b14ace49d34d2941afb541cd1fb711c6c9709 +size 8469943680 diff --git a/Q4_K_M.gguf b/Q4_K_M.gguf new file mode 100644 index 0000000..605a0ac --- /dev/null +++ b/Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fcf289f5f8344cd8704c1054e5e713fd08cf3722c8c4913c8af3eb5161973824 +size 8940328320 diff --git a/Q4_K_S.gguf b/Q4_K_S.gguf new file mode 100644 index 0000000..203e288 --- /dev/null +++ b/Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:40c365951fc0e3ffec8613a21691b3f9aabb883fd4f4fa80ca44c6dfb8366595 +size 8525649280 diff --git a/Q5_0.gguf b/Q5_0.gguf new file mode 100644 index 0000000..1e40cef --- /dev/null +++ b/Q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ad7bda8dfe12d7972c53821d6be6f91174f9377d07593c2fcffdbd317bbb0e94 +size 10214352640 diff --git a/Q5_K_M.gguf b/Q5_K_M.gguf new file mode 100644 index 0000000..48aeefa --- /dev/null +++ b/Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:55b440c4e6a5af0765e1ec8abf4b2f3e8ad6e9d16e609cacb302bfdf8d112e30 +size 10456672000 diff --git a/Q5_K_S.gguf b/Q5_K_S.gguf new file mode 100644 index 0000000..b152403 --- /dev/null +++ b/Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9c28eb723a9bda784fb7bfdab893fa9ed121a64ef41665ca6e11378c46fcb890 +size 10214352640 diff --git a/Q6_K.gguf b/Q6_K.gguf new file mode 100644 index 0000000..ca89baa --- /dev/null +++ b/Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4dc5c1ec6b25b5e85d9e301c46086696c9f5ba23aaf3f8d9994a39ca9cfb1e47 +size 12067787168 diff --git a/Q8_0.gguf b/Q8_0.gguf new file mode 100644 index 0000000..9d07ecd --- /dev/null +++ b/Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:21c1c7b159b8bacfc83e722a9daf81f8a28bd34adbee2ae5c58b44380d5053d9 +size 15627576672 diff --git a/README.md b/README.md new file mode 100644 index 0000000..853c043 --- /dev/null +++ b/README.md @@ -0,0 +1,64 @@ +--- +datasets: +- kristaller486/Nebo-T1-Russian +- Egor-AI/CoT-XLang +- dichspace/darulm +language: +- ru +pipeline_tag: text-generation +license: apache-2.0 +--- + +## Описание модели + +WORK IN PROGRESS!!! Текущая версия v1. + +Инструктивная версия адаптированной на русский язык модели deepseek-ai/DeepSeek-R1-Distill-Qwen-14B. В модели был заменен токенизатор, затем произведено дообучение (Continued pretraining) на русскоязычном корпусе, после чего была применена техника LEP (Learned Embedding Propagation). + +Благодаря новому токенизатору (расширенный tiktoken cl100k с помощью униграм токенизатора на 48 т. токенов) скорость генерации* русскоязычных текстов возрасла до 60% по сравнению с исходной моделью deepseek-ai/DeepSeek-R1-Distill-Qwen-14B. + +*Под скоростью генерации подразумевается количество русскоязычных символов/слов в секунду на одинаковых текстовых последовательностях. + +## Попробовать + +Модель можно попробовать в поднятом Space (внизу в параметрах выбор модели): +https://huggingface.co/spaces/RefalMachine/RuadaptQwen2.5 + +## Токенизация + + +![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/O4eQEhnowETEatDPcmArB.png) + + +![image/png](https://cdn-uploads.huggingface.co/production/uploads/652cedbdf120598322ae358a/oW0Q6LzD_Py3GdH0kfqu4.png) + +## Метрики и оценка качества + +Модель была оценена на Ru-Arena-General, MERA, llmtf_open + +#### Результаты на Ru-Arena-General + +Замеры были произведены с использованием оффициального кода лидерборда (https://github.com/VikhrModels/ru_llm_arena), **но с repetition_penalty=1.1**. + +TODO + +#### Результаты на MERA + +Для сабмита на MERA был подготовлен кастомный системный промпт, который смягчает недостатки оценки на кодовых задачах. Для сравнения был также сделан сабмит с этим же системным промптом оригинальной модели. + +TODO + + +#### Результаты на llmtf_open + +TODO + +## How to cite: + +Tikhomirov M., Chernyshev D. Facilitating large language model Russian adaptation with Learned Embedding Propagation // 2024 (Preprint: https://arxiv.org/abs/2412.21140) + +Tikhomirov M., Chernyshev D. Impact of Tokenization on LLaMa Russian Adaptation //2023 Ivannikov Ispras Open Conference (ISPRAS). – IEEE, 2023. – С. 163-168. + +## Предупреждение + +Ответы модели не отражают мнения авторов, а лишь повторяют знания полученные из данных на всех этапах обучения (предобучение, смена токенизатора, обучение на инструкциях, калибровка качества ответов). Модель была получена из сторонней предобученной модели, **контроль за предобучением** которой **не является ответственностью текущих авторов**. При создании данной версии модели не производилось никаких дополнительных действий, направленных на изменение заложенных в LLM "мнений". Используйте с осторожностью. \ No newline at end of file