Интересное:
Жена композитора Игоря Поклада пострадала во время ракетной атаки на Киевщину

Жена композитора Игоря Поклада пострадала во время ракетной атаки на Киевщину

“Курган и Agregat” провели аукцион на концерте в Киеве, выручив для ВСУ 3,5 миллиона гривен

“Курган и Agregat” провели аукцион на концерте в Киеве, выручив для ВСУ 3,5 миллиона гривен

Стивен Спилберг объяснил финал “Списка Шиндлера”

Стивен Спилберг объяснил финал “Списка Шиндлера”

Dying Light
Совокупные продажи серии Dying Light составили 30 млн копий

Dying Light Совокупные продажи серии Dying Light составили 30 млн копий

Пирс Морган госпитализирован со сломанным бедром после того, как «споткнулся на маленьком шаге», поделился селфи со своей больничной койки

Пирс Морган госпитализирован со сломанным бедром после того, как «споткнулся на маленьком шаге», поделился селфи со своей больничной койки

Посмотрите самые очаровательные ретро-фотографии Голди Хоун и Курта Рассела с их четырьмя детьми

Посмотрите самые очаровательные ретро-фотографии Голди Хоун и Курта Рассела с их четырьмя детьми

Режиссер “What If…?” раскрыл новые детали сериала “Marvel Zombies” с рейтингом TV-MA

Режиссер “What If…?” раскрыл новые детали сериала “Marvel Zombies” с рейтингом TV-MA

Украинка Усанова на Miss Eco International-2024 представит ресайкл-костюм птицы Феникс

Украинка Усанова на Miss Eco International-2024 представит ресайкл-костюм птицы Феникс

EL Кравчук сыграет Тараса Шевченко в новом мюзикле

EL Кравчук сыграет Тараса Шевченко в новом мюзикле

Звезды, которые были баснословно богатыми до того, как стали знаменитыми

Звезды, которые были баснословно богатыми до того, как стали знаменитыми

Home » Технологии » Microsoft VALL-E – новая ИИ-модель, способная адаптироваться к голосу по образцу, длительностью в 3 секунды Информация

Microsoft VALL-E - новая ИИ-модель, способная адаптироваться к голосу по образцу, длительностью в 3 секунды Информация

Искусственный интеллект

Исследователи компании Microsoft представили одну из своих последних разработок, модель искусственного интеллекта (ИИ) под названием VALL-E, которая предназначена для преобразования текста в живую речь. Отметим, что это не первая модель такого рода, но если алгоритму Lyrebird 2017, к примеру, разработанному в университете Монреаля, требовалась целая минута записи для анализа, то модели VALL-E достаточно всего трех секунд, после чего она начинает подражать речи конкретного человека, включая акустическую окраску и эмоциональный тон.
Модель VALL-E была натренирована на 60 тысячах часах записи речи на английском языке, главным образом на аудиокнигах, начитанных разными людьми. Это дало свой результат, модель воспроизводит предложения, звучащие совершенно естественно. Единственным недостатком модели является то, что модель дает сбои в звучании, когда в предложениях встречаются странные места с точки зрения синтаксиса или пунктуации.
Модели VALL-E также дается очень хорошо воссоздание условий аудиосреды исходного образца. Если этот образец, к примеру, был записан с телефона, то и вся дальнейшая синтезированная речь будет “как из телефона”. Также модель способна воспроизводить тонкости речи, похожие образцы, записанные американцем или британцем, дадут совершенно различные результаты.
Также модель VALL-E способна придавать речи эмоциональный окрас. Только для этого ей необходимо предоставить несколько образцов речи, помеченных, как сердитый, сонный, удивленный, чувствующий отвращение и т.п. Чем больше таких образцов будет предоставлено, тем более эмоциональной и естественной становится синтезированная речь.
Последствия появления таких технологий весьма ясны. С положительной стороны, вы можете получить озвученный голосом известного актера список покупок, находясь в супермаркете, или ваш телефон будет начитывать аудиокнигу подходящим для ее содержимого голосом, или даже несколькими голосами.
Но с отрицательной стороны все выглядит намного ужасней. Представьте себе мошенника, получившего образец вашего голоса, который потом звонит вашим ближним родственникам. Также при помощи данной технологии возможен обход систем голосовой идентификации, а фальсифицированная запись выступления какого-либо известного политика может вызвать сокрушительный крах его карьеры.
И в заключении следует отметить, что все мы в последнее время видим, что системы искусственного интеллекта типа DALL-E, ChatGPT и другие deepfake-технологии начинают перемещаться из лабораторий в реальный мир. И эти изменения, как обычно, приносят одновременно массу новых возможностей и новых рисков. Но, надо надеяться, что упомянутые выше риски не столь значимы, как говорится, клин клином вышибают, и распознать фальсифицированную речь сможет подобная и специально натренированная модель искусственного интеллекта.

March 2026
M T W T F S S
 1
2345678
9101112131415
16171819202122
23242526272829
3031  

О сайте

Новости о жизни звезд и знаменитостей – самая актуальная информация. Самые последние новости звезд шоу-бизнеса. Новости телешоу, сериалов.

© Copyright © 2022-2024. – All Rights Reserved.