Text Classification
Transformers
PyTorch
Catalan
roberta
catalan
semantic textual similarity
sts-ca
CaText
Catalan Textual Corpus
Eval Results (legacy)
text-embeddings-inference
Instructions to use projecte-aina/roberta-base-ca-v2-cased-sts with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use projecte-aina/roberta-base-ca-v2-cased-sts with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-classification", model="projecte-aina/roberta-base-ca-v2-cased-sts")# pip install -U transformers accelerate # Load model directly from transformers import AutoTokenizer, AutoModelForSequenceClassification tokenizer = AutoTokenizer.from_pretrained("projecte-aina/roberta-base-ca-v2-cased-sts") model = AutoModelForSequenceClassification.from_pretrained("projecte-aina/roberta-base-ca-v2-cased-sts", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Download tokenizer_config.json from projecte-aina/roberta-base-ca-v2-cased-sts: direct link, hf CLI and curl.
- Browser
- Download file 1.13 kB
-
https://huggingface.co/projecte-aina/roberta-base-ca-v2-cased-sts/resolve/main/tokenizer_config.json
- Command line
-
hf download hf://projecte-aina/roberta-base-ca-v2-cased-sts/tokenizer_config.json
-
curl -L -o tokenizer_config.json https://huggingface.co/projecte-aina/roberta-base-ca-v2-cased-sts/resolve/main/tokenizer_config.json
1.13 kB
| {"unk_token": {"content": "<unk>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "bos_token": {"content": "<s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "eos_token": {"content": "</s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "add_prefix_space": true, "errors": "replace", "sep_token": {"content": "</s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "cls_token": {"content": "<s>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "pad_token": {"content": "<pad>", "single_word": false, "lstrip": false, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "mask_token": {"content": "<mask>", "single_word": false, "lstrip": true, "rstrip": false, "normalized": true, "__type": "AddedToken"}, "max_len": 512, "special_tokens_map_file": null, "name_or_path": "/gpfs/projects/bsc88/BERTs/models/roberta_base_ca_jsc/transformed_lr0.0005"} |