更新 fix_tokenizer.py
This commit is contained in:
@@ -37,6 +37,8 @@ else:
|
|||||||
# ===== 自动修复策略 =====
|
# ===== 自动修复策略 =====
|
||||||
if typ == "fast":
|
if typ == "fast":
|
||||||
cfg["tokenizer_class"] = "PreTrainedTokenizerFast"
|
cfg["tokenizer_class"] = "PreTrainedTokenizerFast"
|
||||||
|
cfg["from_slow"] = False
|
||||||
|
cfg.pop("backend", None)
|
||||||
|
|
||||||
elif typ == "sentencepiece":
|
elif typ == "sentencepiece":
|
||||||
cfg["tokenizer_class"] = "LlamaTokenizer"
|
cfg["tokenizer_class"] = "LlamaTokenizer"
|
||||||
|
|||||||
Reference in New Issue
Block a user