初始化项目,由ModelHub XC社区提供模型

Model: RudraChakrin/Llama-3.1-8B-Instruct-TTS-Phonetic-Denglish
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-04 04:09:17 +08:00
commit f627813a48
11 changed files with 842 additions and 0 deletions

18
tokenizer_config.json Normal file
View File

@@ -0,0 +1,18 @@
{
"backend": "tokenizers",
"bos_token": "<|begin_of_text|>",
"clean_up_tokenization_spaces": true,
"eos_token": "<|eot_id|>",
"from_slow": true,
"is_local": false,
"legacy": false,
"model_input_names": [
"input_ids",
"attention_mask"
],
"model_max_length": 8192,
"pad_token": "<|reserved_special_token_250|>",
"padding_side": "right",
"tokenizer_class": "TokenizersBackend",
"chat_template": "{% if messages[0]['role'] == 'system' %}{% set loop_messages = messages %}{% else %}{% set default_system = [{'role': 'system', 'content': 'You are a phonetic transcriber. Transpose only English and Denglish words into German phonetics.'}] %}{% set loop_messages = default_system + messages %}{% endif %}{% for message in loop_messages %}{% if loop.index0 == 0 %}{{ bos_token }}{% endif %}{{ '<|start_header_id|>' + message['role'] + '<|end_header_id|>\n\n' }}{% if message['role'] == 'user' %}{{ '[DENGLISH]' + message['content'] | trim + '<|eot_id|>' }}{% else %}{{ message['content'] | trim + '<|eot_id|>' }}{% endif %}{% endfor %}{% if add_generation_prompt %}{{ '<|start_header_id|>assistant<|end_header_id|>\n\n' }}{% endif %}"
}