Fish Audio представила Drama 3: превью-модель для речи и озвучки.
Компания Fish Audio представила новую превью-модель Fish Audio Drama 3 для речи и озвучки. Вместо жёстких аудиотегов интонация, темп и характер персонажа описываются обычным текстом.
Возможности
- перегенерация одного слова или фразы в готовой дорожке;
- смена голоса прямо посреди предложения;
- диалоги нескольких героев за один проход;
- работа на русском языке.
Технические детали
- голос по ID модели или zero-shot клонирование по референсам;
- диалоги через теги
<|speaker:0|>,<|speaker:1|>; - форматы WAV/MP3/Opus, до 48 kHz.
Мультиспикер-диалоги есть и в S2-семействе, не только в Drama 3.

