更新 fix_tokenizer.py
This commit is contained in:
@@ -37,6 +37,8 @@ else:
|
||||
# ===== 自动修复策略 =====
|
||||
if typ == "fast":
|
||||
cfg["tokenizer_class"] = "PreTrainedTokenizerFast"
|
||||
cfg["from_slow"] = False
|
||||
cfg.pop("backend", None)
|
||||
|
||||
elif typ == "sentencepiece":
|
||||
cfg["tokenizer_class"] = "LlamaTokenizer"
|
||||
|
||||
Reference in New Issue
Block a user