Feature Extraction
sentence-transformers
Safetensors
French
deberta-v2
sparse-encoder
sparse
csr
Generated from Trainer
dataset_size:12227
loss:SpladeLoss
loss:SparseCosineSimilarityLoss
loss:FlopsLoss
Eval Results (legacy)
text-embeddings-inference
Instructions to use CATIE-AQ/SPLADE_camemberta2.0_STS with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use CATIE-AQ/SPLADE_camemberta2.0_STS with sentence-transformers:
from sentence_transformers import SparseEncoder model = SparseEncoder("CATIE-AQ/SPLADE_camemberta2.0_STS") queries = ["Which planet is known as the Red Planet?"] documents = [ "Venus is often called Earth's twin because of its similar size and proximity.", "Mars, known for its reddish appearance, is often referred to as the Red Planet.", "Jupiter, the largest planet in our solar system, has a prominent red spot.", ] query_embeddings = model.encode_query(queries) document_embeddings = model.encode_document(documents) similarities = model.similarity(query_embeddings, document_embeddings) print(similarities) - Notebooks
- Google Colab
- Kaggle
Download special_tokens_map.json from CATIE-AQ/SPLADE_camemberta2.0_STS: direct link, hf CLI and curl.
- Browser
- Download file 971 Bytes
-
https://huggingface.co/CATIE-AQ/SPLADE_camemberta2.0_STS/resolve/main/special_tokens_map.json
- Command line
-
hf download hf://CATIE-AQ/SPLADE_camemberta2.0_STS/special_tokens_map.json
-
curl -L -o special_tokens_map.json https://huggingface.co/CATIE-AQ/SPLADE_camemberta2.0_STS/resolve/main/special_tokens_map.json
971 Bytes
| { | |
| "bos_token": { | |
| "content": "[CLS]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "cls_token": { | |
| "content": "[CLS]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "eos_token": { | |
| "content": "[SEP]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "mask_token": { | |
| "content": "[MASK]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "pad_token": { | |
| "content": "[PAD]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "sep_token": { | |
| "content": "[SEP]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| }, | |
| "unk_token": { | |
| "content": "[UNK]", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false | |
| } | |
| } | |