Модель MOSS-TTS-v1.5 от OpenMOSS-Team заняла первое место на Hugging Face.
Модель MOSS-TTS-v1.5 вышла на первое место в рейтинге Hugging Face Trending среди Text-to-Speech моделей и уже набрала 20,6 тысяч загрузок.
Это мультиязычная управляемая TTS-модель, которая умеет:
- стабильно клонировать голос;
- генерировать длинные аудио;
- точно управлять паузами;
- работать с несколькими языками.
Теперь MOSS-TTS-v1.5 официально поддерживается в vLLM-Omni и SGLang-Omni, что делает её интересной не только для экспериментов, но и для более серьёзной инфраструктуры голосовых приложений.
Модель разработала команда OpenMOSS-Team.
GitHub: https://github.com/OpenMOSS/MOSS-TTS
Hugging Face: https://huggingface.co/OpenMOSS-Team/MOSS-TTS-v1.5
ModelScope: https://modelscope.ai/organization/openmoss

