更新 fix_tokenizer.py

This commit is contained in:
2026-07-21 16:55:50 +08:00
parent b324b7140a
commit 5d34d33e0d

View File

@@ -37,6 +37,8 @@ else:
# ===== 自动修复策略 =====
if typ == "fast":
cfg["tokenizer_class"] = "PreTrainedTokenizerFast"
cfg["from_slow"] = False
cfg.pop("backend", None)
elif typ == "sentencepiece":
cfg["tokenizer_class"] = "LlamaTokenizer"