Instructions to use CCC-Unito/Minerva-Tokenizer-Special-Tokens with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use CCC-Unito/Minerva-Tokenizer-Special-Tokens with Transformers:
# pip install -U transformers accelerate # Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("CCC-Unito/Minerva-Tokenizer-Special-Tokens", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Download special_tokens_map.json from CCC-Unito/Minerva-Tokenizer-Special-Tokens: direct link, hf CLI and curl.
- Browser
- Download file 1.71 kB
-
https://huggingface.co/CCC-Unito/Minerva-Tokenizer-Special-Tokens/resolve/main/special_tokens_map.json
- Command line
-
hf download hf://CCC-Unito/Minerva-Tokenizer-Special-Tokens/special_tokens_map.json
-
curl -L -o special_tokens_map.json https://huggingface.co/CCC-Unito/Minerva-Tokenizer-Special-Tokens/resolve/main/special_tokens_map.json
1.71 kB
| { | |
| "additional_special_tokens": [ | |
| { | |
| "content": "<WIKI>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<LIB>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<NEWS>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<CONV>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<SUBT>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<TWIT>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<FORUM>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<LAW>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| { | |
| "content": "<OTHER>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| } | |
| ], | |
| "bos_token": { | |
| "content": "<s>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "eos_token": { | |
| "content": "</s>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "unk_token": { | |
| "content": "<unk>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| } | |
| } | |