• Рецепты осени: творожные оладьи с яблоками

    Рецепты осени: творожные оладьи с яблоками

    23.09.18

    0

    17

  • В MIT создают аккумулятор, который поглощает углекислый газ

    В MIT создают аккумулятор, который поглощает углек...

    23.09.18

    0

    11

  • Разработан спрей для нанесения тактильных сенсоров на любую поверхность

    Разработан спрей для нанесения тактильных сенсоров...

    23.09.18

    0

    6

  • Россия не будет участвовать в создании американской лунной станции

    Россия не будет участвовать в создании американско...

    23.09.18

    0

    10

  • Бермудский монстр: ученые раскрыли тайны выброшенных на берег чудовищ

    Бермудский монстр: ученые раскрыли тайны выброшенн...

    23.09.18

    0

    29

Китайские разработчики научили ИИ говорить человеческим голосом

Китайские разработчики научили ИИ говорить человеческим голосом
  • 13.03.18
  • 0
  • 1126
  • фон:

Специалисты китайской лаборатории Baidu Research, принадлежащей крупнейшему поисковому гиганту Поднебесной, создали алгоритм ИИ Deep Voice, способный преобразовывать текст в речь. Подобные проекты, существовавшие до этого, сталкивались с проблемой скорости синтеза звука, поэтому для генерации голоса предшественникам Deep Vice требовалось от нескольких минут до пары часов, чтобы корректно и максимально натуралистично воспроизвести текст человеческим голосом. Новая разработка китайских учёных основана на нейронных сетях и способна преобразовывать текст в голос в реальном времени.

Deep Voice умеет имитировать тембр, интонацию голоса и акцент, делая их очень правдоподобными и почти неотличимыми от настоящих, при этом голос может быть мужским или женским. Разработчики уверены, что их технологию можно использовать в качестве цифровых помощников, применять для записи голосов в идеоиграх или же вовсе использовать для синхронного перевода фильмов по субтитрам.

«Это настоящий прорыв с технической точки зрения, ведь мы смогли решить сложнейшую проблему, синтезировав живую речь со всеми ее особенностями», — говорит Лео Зу, один из авторов проекта.

Создатели алгоритма пояснили, что проект Deep Voice вдохновлён аналогичными разработками, вот только все его компоненты работают под управлением нейронной сети, при этом используя в работе довольно простые функции, что делает их алгоритм весьма адаптивным — голоса можно подстроить «под себя», наделив систему новыми акцентами и другими особенностями.

«Глубокое обучение привело к революции в различных областях, таких как компьютерное зрение и распознавание речи, а сейчас настало время и голосового синтеза. Мы рады, что смогли добиться таких результатов, и будем работать дальше, чтобы сделать систему «текст-голос» ещё более реалистичной», — приводит Motherboard цитату разработчиков.

Источник