Голосовые движки, синтезаторы речи

Аватара пользователя
Tzratzk
Отец-основатель
Сообщения: 27653
Зарегистрирован: 06 май 2006, 07:55
Откуда: Москва
Контактная информация:

Голосовые движки, синтезаторы речи

Сообщение Tzratzk » 28 дек 2017, 16:26

Google «заговорил» человеческим голосом


Специалисты поискового гиганта Google опубликовали статью, в которой рассказали о том, что создали генератор речи, способный говорить неотличимым от живого человека голосом. Разработка называется Tacotron 2 и умеет очень качественно преобразовывать текст в речь. Программа представляет собой две взаимосвязанные нейросети глубокого обучения. Первая нейросеть создаёт на основе текста спектрограмму и передаёт её второму алгоритму WaveNet, который её и озвучивает «голосом». Tacotron 2 знает множество нюансов, без труда справляется со сложными в произношении словами и, читая с листа, учитывает пунктуацию. Благодаря этому, например, она различает конец предложения и начало нового, выделяя их интонацией.

Образцы работы приложения специалисты уже выложили на страничке, посвящённой разработке. https://google.github.io/tacotron/publi ... index.html

Звучит это гораздо лучше, чем монотонные механические голоса современных программ озвучивания, поэтому, надо полагать, Google быстро найдёт разработке применение. WaveNet уже используется в Google Assistant, поэтому Tacotron 2 наверняка станет для неё отличным дополнением.

На данном этапе разработки Tacotron 2 говорит только приятным женским голосом, но, вероятно, в будущем обзаведётся и мужским вариантом, а, учитывая её способность к обучению, возможно, научится и имитировать другие голоса.


https://hi-news.ru/technology/google-za ... losom.html

Вернуться в «Книги»