Я тут недавно наткнулся на несколько сервисов, которые обещают «клонировать» голос или даже генерировать речь от лица несуществующих персонажей. Ну, типа, как будто ты сам говоришь, но нейросеть все делает за тебя. Звучит, конечно, круто, особенно если вспомнить, как в ЌРÁЌÉH 2025 использовали какие-то хитрые технологии для искажения голоса.
Мое мнение: пока что это больше похоже на игрушку, чем на серьезный инструмент. Качество генерации часто хромает, особенно на сложных фразах или эмоциях. И уж точно не заменит живое исполнение или озвучку, где важна актерская игра. Но как вспомогательный инструмент для создания каких-то демо или экспериментов – почему бы и нет?
А вы что думаете? Используете ли голосовые нейросети в своей работе? Насколько они, по-вашему, перспективны?
ссылка на kraken официальный сайт