Files
paraphrase-mpnet-base-v2_ss…/tokenizer_config.json
ModelHub XC 1f44ef9d08 初始化项目,由ModelHub XC社区提供模型
Model: orenpereg/paraphrase-mpnet-base-v2_sst2_4samps
Source: Original Platform
2026-07-30 03:44:17 +08:00

1 line
1.2 KiB
JSON

{"do_lower_case": true, "bos_token": {"content": "<s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "eos_token": {"content": "</s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "sep_token": {"content": "</s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "cls_token": {"content": "<s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "unk_token": {"content": "[UNK]", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "pad_token": {"content": "<pad>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "mask_token": {"content": "<mask>", "single_word": false, "lstrip": true, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "tokenize_chinese_chars": true, "strip_accents": null, "model_max_length": 512, "special_tokens_map_file": null, "name_or_path": "/home/oren_nlp/.cache/torch/sentence_transformers/sentence-transformers_paraphrase-mpnet-base-v2/", "do_basic_tokenize": true, "never_split": null, "tokenizer_class": "MPNetTokenizer"}