• Привычка оставаться: почему мы так упорно пытаемся сохранить отношения

    Привычка оставаться: почему мы так упорно пытаемся...

    17.06.18

    0

    139

  • Дезодорант или антиперспирант: что выбрать и как пользоваться

    Дезодорант или антиперспирант: что выбрать и как п...

    17.06.18

    0

    148

  • Метаболический синдром, или почему вы набираете вес

    Метаболический синдром, или почему вы набираете ве...

    17.06.18

    0

    143

  • Kia рассказала о новом Ceed для России

    Kia рассказала о новом Ceed для России

    17.06.18

    0

    134

  • Китайцы увеличили пробег самого дешевого в мире электрокара

    Китайцы увеличили пробег самого дешевого в мире эл...

    17.06.18

    0

    90

Китайские разработчики научили ИИ говорить человеческим голосом

Китайские разработчики научили ИИ говорить человеческим голосом
  • 13.03.18
  • 0
  • 965
  • фон:

Специалисты китайской лаборатории Baidu Research, принадлежащей крупнейшему поисковому гиганту Поднебесной, создали алгоритм ИИ Deep Voice, способный преобразовывать текст в речь. Подобные проекты, существовавшие до этого, сталкивались с проблемой скорости синтеза звука, поэтому для генерации голоса предшественникам Deep Vice требовалось от нескольких минут до пары часов, чтобы корректно и максимально натуралистично воспроизвести текст человеческим голосом. Новая разработка китайских учёных основана на нейронных сетях и способна преобразовывать текст в голос в реальном времени.

Deep Voice умеет имитировать тембр, интонацию голоса и акцент, делая их очень правдоподобными и почти неотличимыми от настоящих, при этом голос может быть мужским или женским. Разработчики уверены, что их технологию можно использовать в качестве цифровых помощников, применять для записи голосов в идеоиграх или же вовсе использовать для синхронного перевода фильмов по субтитрам.

«Это настоящий прорыв с технической точки зрения, ведь мы смогли решить сложнейшую проблему, синтезировав живую речь со всеми ее особенностями», — говорит Лео Зу, один из авторов проекта.

Создатели алгоритма пояснили, что проект Deep Voice вдохновлён аналогичными разработками, вот только все его компоненты работают под управлением нейронной сети, при этом используя в работе довольно простые функции, что делает их алгоритм весьма адаптивным — голоса можно подстроить «под себя», наделив систему новыми акцентами и другими особенностями.

«Глубокое обучение привело к революции в различных областях, таких как компьютерное зрение и распознавание речи, а сейчас настало время и голосового синтеза. Мы рады, что смогли добиться таких результатов, и будем работать дальше, чтобы сделать систему «текст-голос» ещё более реалистичной», — приводит Motherboard цитату разработчиков.

Источник