Instructions to use Misha24-10/F5-TTS_RUSSIAN with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- F5-TTS
How to use Misha24-10/F5-TTS_RUSSIAN with F5-TTS:
# No code snippets available yet for this library. # To use this model, check the repository files and the library's documentation. # Want to help? PRs adding snippets are welcome at: # https://github.com/huggingface/huggingface.js
- Notebooks
- Google Colab
- Kaggle
Работа модели в Ultimate tts studio через Pinokio
Добрый день. Установил Вашу модель в Ultimate TTS Studio через Pinokio, методом подмены скачиваемой модели самой U'tts'S.
Всё работает супер, единственное - не получается попробовать тоже самое сделать в v4 (vocals в репозитории отсуствует для неё, и не один их тех что есть не подходит) - модель начинает аброкадабру по английски говорить.
Будет ли абгрейд? Научится ли модель как-то лучше распознавать знаки препинания (пока я заметил что она хорошо работает только с восклицательными знаками, точки более менее - они лучше всех создают паузы, много точек через пробел - часто имитируют вдох (тоже может быть полезно), троеточия - плоховато, часто начинает глотать/пропускать слова, запятые 50/50 работают в зависимости от выставленной скорости произношения, но надёжнее поставить точку. Почти никак с вопросительными знаками, тут только случайность помогает что немного изменится интонация на вопросительную либо референс нужно искать.
А так же еще вопрос по seed - у выходных файлов в названии 6-значный seed на выходе, но он почему-то не бьется с исходным вообще если его забить - получается совершенно другой сэмпл (или это только в U'tts'S такая проблема?)
Кстати все пишут что референс должен быть не длинее 12 секунд, но у меня ест даже двухминутные референсы (но вероятно режет и использует лишь нужную часть)