Files
Llama-3.1-8B-Instruct-TTS-P…/tokenizer_config.json
ModelHub XC f627813a48 初始化项目,由ModelHub XC社区提供模型
Model: RudraChakrin/Llama-3.1-8B-Instruct-TTS-Phonetic-Denglish
Source: Original Platform
2026-08-04 04:09:17 +08:00

19 lines
1.1 KiB
JSON

{
"backend": "tokenizers",
"bos_token": "<|begin_of_text|>",
"clean_up_tokenization_spaces": true,
"eos_token": "<|eot_id|>",
"from_slow": true,
"is_local": false,
"legacy": false,
"model_input_names": [
"input_ids",
"attention_mask"
],
"model_max_length": 8192,
"pad_token": "<|reserved_special_token_250|>",
"padding_side": "right",
"tokenizer_class": "TokenizersBackend",
"chat_template": "{% if messages[0]['role'] == 'system' %}{% set loop_messages = messages %}{% else %}{% set default_system = [{'role': 'system', 'content': 'You are a phonetic transcriber. Transpose only English and Denglish words into German phonetics.'}] %}{% set loop_messages = default_system + messages %}{% endif %}{% for message in loop_messages %}{% if loop.index0 == 0 %}{{ bos_token }}{% endif %}{{ '<|start_header_id|>' + message['role'] + '<|end_header_id|>\n\n' }}{% if message['role'] == 'user' %}{{ '[DENGLISH]' + message['content'] | trim + '<|eot_id|>' }}{% else %}{{ message['content'] | trim + '<|eot_id|>' }}{% endif %}{% endfor %}{% if add_generation_prompt %}{{ '<|start_header_id|>assistant<|end_header_id|>\n\n' }}{% endif %}"
}