初始化项目,由ModelHub XC社区提供模型

Model: julep-ai/dolphin-2.9.1-llama-3-70b-awq
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-25 22:19:53 +08:00
commit a38f03ebf0
17 changed files with 414657 additions and 0 deletions

35
.gitattributes vendored Normal file
View File

@@ -0,0 +1,35 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text

11
README.md Normal file
View File

@@ -0,0 +1,11 @@
---
library_name: transformers
tags: []
---
# Model Card for dolphin-2.9.1-llama-3-70b-<u>awq</u>
AWQ Quantized version of [cognitivecomputations/dolphin-2.9.1-llama-3-70b](/cognitivecomputations/dolphin-2.9.1-llama-3-70b).
For use with vllm and other inference engines.

42
config.json Normal file
View File

@@ -0,0 +1,42 @@
{
"_name_or_path": "./dolphin-2.9.1-llama-3-70b-awq",
"architectures": [
"LlamaForCausalLM"
],
"attention_bias": false,
"attention_dropout": 0.0,
"bos_token_id": 128000,
"eos_token_id": 128256,
"hidden_act": "silu",
"hidden_size": 8192,
"initializer_range": 0.02,
"intermediate_size": 28672,
"max_position_embeddings": 8192,
"mlp_bias": false,
"model_type": "llama",
"num_attention_heads": 64,
"num_hidden_layers": 80,
"num_key_value_heads": 8,
"pretraining_tp": 1,
"quantization_config": {
"backend": "autoawq",
"bits": 4,
"do_fuse": false,
"exllama_config": null,
"fuse_max_seq_len": null,
"group_size": 128,
"modules_to_fuse": null,
"modules_to_not_convert": null,
"quant_method": "awq",
"version": "gemm",
"zero_point": true
},
"rms_norm_eps": 1e-05,
"rope_scaling": null,
"rope_theta": 500000.0,
"tie_word_embeddings": false,
"torch_dtype": "float16",
"transformers_version": "4.41.0",
"use_cache": false,
"vocab_size": 128258
}

9
generation_config.json Normal file
View File

@@ -0,0 +1,9 @@
{
"bos_token_id": 128000,
"do_sample": true,
"eos_token_id": 128001,
"max_length": 4096,
"temperature": 0.6,
"top_p": 0.9,
"transformers_version": "4.41.0"
}

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b3018fcce46ffdf0f1775f6c792cc2f0ab414442e61271fe7e70c04c4d98e380
size 4969251896

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:fc601b43b4e24c2bebb3db3ca8e2c9f23a2412e8afbb661e8e540afd761142d5
size 4890226896

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:87dc8765d64d2325d6a2df1d1e47bad938d0be6bdef69f4c0768ba66854ce245
size 4890226992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4f68d38a7d5b48f306c0f4633983653711e33ebab7c99639d204d6b542873cf7
size 4890226992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:205817ac63732c0b444e23c8e2be6172c206fd821a0a7c32f8181fd70340998b
size 4890226992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4b6c7cabca45b21723ba6fac935efc28e0ab1fbf842fb782332fe57a679a8595
size 4890226992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:096b8225689190f05474cb40f406166049c389064360f753e921369e6ff44d79
size 4890226992

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:704089acb46967bd850f80ecca0ef681f43ab0bef047b8821627974b2f745282
size 3356068840

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:56d691dce48b6d96cffc8f8d2b4ae3421ce64ff46865c976db0bb0b718dd9b47
size 2101379200

1850
model.safetensors.index.json Normal file

File diff suppressed because it is too large Load Diff

23
special_tokens_map.json Normal file
View File

@@ -0,0 +1,23 @@
{
"bos_token": {
"content": "<|begin_of_text|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"eos_token": {
"content": "<|im_end|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"pad_token": {
"content": "<|end_of_text|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
}
}

410581
tokenizer.json Normal file

File diff suppressed because it is too large Load Diff

2079
tokenizer_config.json Normal file

File diff suppressed because it is too large Load Diff