Create translation.py
Browse files- pipeline/translation.py +10 -0
pipeline/translation.py
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
|
| 2 |
+
|
| 3 |
+
_model_name = "Helsinki-NLP/opus-mt-en-hi"
|
| 4 |
+
_tokenizer = AutoTokenizer.from_pretrained(_model_name)
|
| 5 |
+
_model = AutoModelForSeq2SeqLM.from_pretrained(_model_name)
|
| 6 |
+
|
| 7 |
+
def translate_text(text: str) -> str:
|
| 8 |
+
inputs = _tokenizer(text, return_tensors="pt", truncation=True)
|
| 9 |
+
outputs = _model.generate(**inputs, max_new_tokens=200)
|
| 10 |
+
return _tokenizer.decode(outputs[0], skip_special_tokens=True)
|