tokenizer_config.json
365 B · 16 lines · json Raw
1 {
2 "cls_token": "[CLS]",
3 "do_basic_tokenize": true,
4 "do_lower_case": false,
5 "mask_token": "[MASK]",
6 "model_max_length": 512,
7 "never_split": null,
8 "pad_token": "[PAD]",
9 "sep_token": "[SEP]",
10 "special_tokens_map_file": null,
11 "strip_accents": null,
12 "tokenize_chinese_chars": true,
13 "tokenizer_class": "ElectraTokenizer",
14 "unk_token": "[UNK]"
15 }
16