初始化项目,由ModelHub XC社区提供模型
Model: cortexso/deepseek-r1-distill-llama-8b Source: Original Platform
This commit is contained in:
47
.gitattributes
vendored
Normal file
47
.gitattributes
vendored
Normal file
@@ -0,0 +1,47 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zstandard filter=lfs diff=lfs merge=lfs -text
|
||||
*.tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
*.db* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ark* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
|
||||
**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.gguf* filter=lfs diff=lfs merge=lfs -text
|
||||
*.ggml filter=lfs diff=lfs merge=lfs -text
|
||||
*.llamafile* filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
42
README.md
Normal file
42
README.md
Normal file
@@ -0,0 +1,42 @@
|
||||
---
|
||||
license: mit
|
||||
pipeline_tag: text-generation
|
||||
tags:
|
||||
- cortex.cpp
|
||||
---
|
||||
|
||||
## Overview
|
||||
|
||||
**DeepSeek** developed and released the [DeepSeek R1 Distill Llama 8B](https://huggingface.co/deepseek-ai/DeepSeek-R1-Distill-Llama-8B) model, a distilled version of the Llama 8B language model. This variant is fine-tuned for high-performance text generation, optimized for dialogue, and tailored for information-seeking tasks. It offers a robust balance between model size and performance, making it suitable for demanding conversational AI and research use cases.
|
||||
|
||||
The model is designed to deliver accurate, efficient, and safe responses in applications such as customer support, knowledge systems, and research environments.
|
||||
|
||||
|
||||
## Variants
|
||||
|
||||
| No | Variant | Cortex CLI command |
|
||||
| --- | --- | --- |
|
||||
| 1 | [Deepseek-r1-distill-llama-8b-8b](https://huggingface.co/cortexso/deepseek-r1-distill-llama-8b/tree/8b) | `cortex run deepseek-r1-distill-llama-8b:8b` |
|
||||
|
||||
## Use it with Jan (UI)
|
||||
|
||||
1. Install **Jan** using [Quickstart](https://jan.ai/docs/quickstart)
|
||||
2. Use in Jan model Hub:
|
||||
```bash
|
||||
cortexso/deepseek-r1-distill-llama-8b
|
||||
```
|
||||
|
||||
## Use it with Cortex (CLI)
|
||||
|
||||
1. Install **Cortex** using [Quickstart](https://cortex.jan.ai/docs/quickstart)
|
||||
2. Run the model with command:
|
||||
```bash
|
||||
cortex run deepseek-r1-distill-llama-8b
|
||||
```
|
||||
|
||||
## Credits
|
||||
|
||||
- **Author:** DeepSeek
|
||||
- **Converter:** [Homebrew](https://www.homebrew.ltd/)
|
||||
- **Original License:** [License](https://huggingface.co/deepseek-ai/DeepSeek-R1-Distill-Llama-8B#7-license)
|
||||
- **Papers:** [DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning](https://arxiv.org/html/2501.12948v1)
|
||||
1
configuration.json
Normal file
1
configuration.json
Normal file
@@ -0,0 +1 @@
|
||||
{"framework": "pytorch", "task": "text-generation", "allow_remote": true}
|
||||
3
deepseek-r1-distill-llama-8b-q2_k.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q2_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:0a08758a3d1a5afbfebc3a03f21c1cee1cb9cd72e521ad7f1bbc63ab3654b766
|
||||
size 3179133440
|
||||
3
deepseek-r1-distill-llama-8b-q3_k_l.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q3_k_l.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b565abbfc590af0b70c5d1698f2d0a117f11c46d44434a13a8e3eb33a84371f0
|
||||
size 4321958400
|
||||
3
deepseek-r1-distill-llama-8b-q3_k_m.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q3_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:cbafcb3f09ccf982193a902801e4d14466a3260dca8e1c6611e24cfb13c155a0
|
||||
size 4018919936
|
||||
3
deepseek-r1-distill-llama-8b-q3_k_s.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q3_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:621f37a83aa9df187ffad8bbf35d0b192141f086e7ef1330fe863b50c0bc1686
|
||||
size 3664501248
|
||||
3
deepseek-r1-distill-llama-8b-q4_k_m.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q4_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:cc7d4d31adef013fd42d7b6a419560d4a26fe018a500221010f073779eca9e53
|
||||
size 4920736256
|
||||
3
deepseek-r1-distill-llama-8b-q4_k_s.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q4_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:86b9e22ce8c2ba3a1bec95c6b35b54849139880ea313fcf7958d81aca3a34a9e
|
||||
size 4692670976
|
||||
3
deepseek-r1-distill-llama-8b-q5_k_m.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q5_k_m.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:92af522f96251b63d9be7d2b0dcd9a69879029a9a9f22a384ba3d881907136b6
|
||||
size 5732989440
|
||||
3
deepseek-r1-distill-llama-8b-q5_k_s.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q5_k_s.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:87bb9c87794813398e271cc8dbff3a2fbba3f2084e0a974534e104a0f8f2e856
|
||||
size 5599296000
|
||||
3
deepseek-r1-distill-llama-8b-q6_k.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q6_k.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ced528ae38f800e5ef376f88969a1d2b8b79342469a20e04b37af3ad589537e9
|
||||
size 6596008448
|
||||
3
deepseek-r1-distill-llama-8b-q8_0.gguf
Normal file
3
deepseek-r1-distill-llama-8b-q8_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ff9301868a775a5b3b9fd0e7ebe4f3240909597cfc82d104d17dbaa1af0fbd70
|
||||
size 8540772864
|
||||
4
metadata.yml
Normal file
4
metadata.yml
Normal file
@@ -0,0 +1,4 @@
|
||||
version: 1
|
||||
name: deepseek-r1-distill-llama-8b
|
||||
default: 8b
|
||||
author: "DeepSeek-AI"
|
||||
49
model.yml
Normal file
49
model.yml
Normal file
@@ -0,0 +1,49 @@
|
||||
# BEGIN GENERAL GGUF METADATA
|
||||
id: deepseek-r1-distill-llama-8b
|
||||
model: deepseek-r1-distill-llama-8b
|
||||
name: deepseek-r1-distill-llama-8b
|
||||
version: 1
|
||||
# END GENERAL GGUF METADATA
|
||||
|
||||
# BEGIN INFERENCE PARAMETERS
|
||||
# BEGIN REQUIRED
|
||||
stop:
|
||||
- <|im_end|>
|
||||
- "<\uFF5Cend\u2581of\u2581sentence\uFF5C>"
|
||||
# END REQUIRED
|
||||
|
||||
# BEGIN OPTIONAL
|
||||
stream: true
|
||||
top_p: 0.9
|
||||
temperature: 0.7
|
||||
frequency_penalty: 0
|
||||
presence_penalty: 0
|
||||
max_tokens: 4096
|
||||
seed: -1
|
||||
dynatemp_range: 0
|
||||
dynatemp_exponent: 1
|
||||
top_k: 40
|
||||
min_p: 0.05
|
||||
tfs_z: 1
|
||||
typ_p: 1
|
||||
repeat_last_n: 64
|
||||
repeat_penalty: 1
|
||||
mirostat: false
|
||||
mirostat_tau: 5
|
||||
mirostat_eta: 0.100000001
|
||||
penalize_nl: false
|
||||
ignore_eos: false
|
||||
n_probs: 0
|
||||
min_keep: 0
|
||||
# END OPTIONAL
|
||||
# END INFERENCE PARAMETERS
|
||||
|
||||
# BEGIN MODEL LOAD PARAMETERS
|
||||
# BEGIN REQUIRED
|
||||
engine: llama-cpp
|
||||
prompt_template: "<|start_of_text|>{system_message}<\uFF5CUser\uFF5C>{prompt}<\uFF5C\
|
||||
Assistant\uFF5C>"
|
||||
ctx_len: 4096
|
||||
ngl: 33
|
||||
# END REQUIRED
|
||||
# END MODEL LOAD PARAMETERS
|
||||
Reference in New Issue
Block a user