Audio-to-Audio
PEFT
Safetensors
Moshi
Turkish
Hindi
speech-to-speech-translation
simultaneous-translation
mimi
lora
tpu
turkish
hindi
Eval Results (legacy)
Instructions to use tiny-aya-translate/tr-hi-s2st-v0.3 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use tiny-aya-translate/tr-hi-s2st-v0.3 with PEFT:
Task type is invalid.
- Moshi
How to use tiny-aya-translate/tr-hi-s2st-v0.3 with Moshi:
# pip install moshi # Run the interactive web server python -m moshi.server --hf-repo "tiny-aya-translate/tr-hi-s2st-v0.3" # Then open https://localhost:8998 in your browser
# pip install moshi import torch from moshi.models import loaders # Load checkpoint info from HuggingFace checkpoint = loaders.CheckpointInfo.from_hf_repo("tiny-aya-translate/tr-hi-s2st-v0.3") # Load the Mimi audio codec mimi = checkpoint.get_mimi(device="cuda") mimi.set_num_codebooks(8) # Encode audio (24kHz, mono) wav = torch.randn(1, 1, 24000 * 10) # [batch, channels, samples] with torch.no_grad(): codes = mimi.encode(wav.cuda()) decoded = mimi.decode(codes) - Notebooks
- Google Colab
- Kaggle
| *.7z filter=lfs diff=lfs merge=lfs -text | |
| *.arrow filter=lfs diff=lfs merge=lfs -text | |
| *.bin filter=lfs diff=lfs merge=lfs -text | |
| *.bz2 filter=lfs diff=lfs merge=lfs -text | |
| *.ckpt filter=lfs diff=lfs merge=lfs -text | |
| *.ftz filter=lfs diff=lfs merge=lfs -text | |
| *.gz filter=lfs diff=lfs merge=lfs -text | |
| *.h5 filter=lfs diff=lfs merge=lfs -text | |
| *.joblib filter=lfs diff=lfs merge=lfs -text | |
| *.lfs.* filter=lfs diff=lfs merge=lfs -text | |
| *.mlmodel filter=lfs diff=lfs merge=lfs -text | |
| *.model filter=lfs diff=lfs merge=lfs -text | |
| *.msgpack filter=lfs diff=lfs merge=lfs -text | |
| *.npy filter=lfs diff=lfs merge=lfs -text | |
| *.npz filter=lfs diff=lfs merge=lfs -text | |
| *.onnx filter=lfs diff=lfs merge=lfs -text | |
| *.ot filter=lfs diff=lfs merge=lfs -text | |
| *.parquet filter=lfs diff=lfs merge=lfs -text | |
| *.pb filter=lfs diff=lfs merge=lfs -text | |
| *.pickle filter=lfs diff=lfs merge=lfs -text | |
| *.pkl filter=lfs diff=lfs merge=lfs -text | |
| *.pt filter=lfs diff=lfs merge=lfs -text | |
| *.pth filter=lfs diff=lfs merge=lfs -text | |
| *.rar filter=lfs diff=lfs merge=lfs -text | |
| *.safetensors filter=lfs diff=lfs merge=lfs -text | |
| saved_model/**/* filter=lfs diff=lfs merge=lfs -text | |
| *.tar.* filter=lfs diff=lfs merge=lfs -text | |
| *.tar filter=lfs diff=lfs merge=lfs -text | |
| *.tflite filter=lfs diff=lfs merge=lfs -text | |
| *.tgz filter=lfs diff=lfs merge=lfs -text | |
| *.wasm filter=lfs diff=lfs merge=lfs -text | |
| *.xz filter=lfs diff=lfs merge=lfs -text | |
| *.zip filter=lfs diff=lfs merge=lfs -text | |
| *.zst filter=lfs diff=lfs merge=lfs -text | |
| *tfevents* filter=lfs diff=lfs merge=lfs -text | |
| samples/step_005000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_005000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_005000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_010000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_010000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_010000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_015000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_015000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_015000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_020000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_020000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_020000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_025000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_025000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_025000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_030000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_030000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_030000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_035000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_035000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_035000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_040000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_040000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_040000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_045000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_045000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_045000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_050000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_050000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_050000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_055000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_055000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_055000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_060000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_060000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_060000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_065000/source.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_065000/target_gt.wav filter=lfs diff=lfs merge=lfs -text | |
| samples/step_065000/generated.wav filter=lfs diff=lfs merge=lfs -text | |
| assets/v0.3/emergence-curve.png filter=lfs diff=lfs merge=lfs -text | |
| assets/v0.3/see-it-learn.gif filter=lfs diff=lfs merge=lfs -text | |