Классический форум-трекер
canvas not supported
Нас вместе: 4 248 338


Совeтуeм установить VPN чтобы скрыть Ваш IP-адрес

Microsoft представила VALL-E — ИИ-модель, которая имитирует голос по маленькому образцу


Страницы:   Пред.  1, 2, 3 
 
RSS
Начать новую тему   Ответить на тему    Торрент-трекер NNM-Club -> Компьютеры и комплектующие -> Компьютерные новости
Автор Сообщение
Maximus ®
Вольный стрелок
Uploader 100+
Стаж: 18 лет 4 мес.
Сообщений: 5559
Ratio: 25.234
Поблагодарили: 13345
100%
nnm-club.gif
Microsoft представила модель искусственного интеллекта (ИИ) под названием VALL-E — она преобразует текст в речь, точно имитируя голос человека, а образцом может служить запись продолжительностью всего в три секунды. При этом ИИ сохраняет эмоциональную окраску речи образца.



Авторы проекта говорят, что система окажется полезной при разработке приложений с возможностью высококачественного преобразования текста в речь и при создании аудиоконтента в сочетании с другими ИИ-генераторами контента вроде GPT-3. Хотя они также признают, что её можно использовать для редактирования аудиозаписи по расшифровке — модель может «заставить» человека произносить слова, которых он никогда в реальности не говорил.

При создании модели использовалась разработанная Meta* технология EnCodec, которая обеспечивает эффективное сжатие аудиосигнала. В отличие от традиционных методов преобразования текста в речь, VALL-E не конструирует звуковые волны, а анализирует особенности речи человека, разбивает эти данные на отдельные компоненты (так называемые «токены») и генерирует запись на основе того, что уже «знает» об образце — моделирует голос, как он бы мог звучать за пределами трёхсекундного образца. Обучение модели производилось на библиотеке LibriLight, собранной Meta* — она же, в свою очередь, была построена на 60 000 часов англоязычной речи более чем 7000 носителей: данные были позаимствованы преимущественно из коллекции LibriVox.



В представленных на сайте проекта образцах колонка «Speaker Prompt» содержит образцы речи; в колонке «Ground Truth» представлена запись необходимого текста в исполнении человека, с которого был записан образец; «Baseline» — образец работы традиционных преобразователей текста в речь, а «VALL-E» — работа новой ИИ-модели. Нейросеть также может предложить несколько вариантов необходимого текста с голосом на образце. Создатели системы добавили, что она не только придаёт голосу на генерируемой записи нужный эмоциональный окрас, но и имитирует «акустическое окружение» образца — если исходная запись была сделана с телефонного разговора, то и результат будет напоминать разговор по телефону.

Из-за опасности злоупотреблений технологией Microsoft не стала публиковать код VALL-E для экспериментов, поэтому все желающие протестировать работу модели не смогут. В компании добавили, что аналогичным образом будут поступать и с другими проектами, если они несут потенциальную угрозу злоупотреблений.

* Внесена в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности». Источник
slim326
Стаж: 9 лет
Сообщений: 26
Ratio: 3.118
0.38%
Не очень понимаю а чем Open Ai Whisper отличается от этой пердставленной нейросети, одни присваивают себе то что уже создано, другие печатают все в подряд - современный мир
https://nlpcloud.com/ru/how-to-install-and-deploy-whisper-the-best-open-source-alternative-to-google-speech-to-text.html

Добавлено спустя 5 минут 16 секунд:

Не очень понимаю а чем Open Ai Whisper отличается от этой пердставленной нейросети, одни присваивают себе то что уже создано, другие печатают все в подряд - современный мир
https://nlpcloud.com/ru/how-to-install-and-deploy-whisper-the-best-open-source-alternative-to-google-speech-to-text.html
gj9159a
 
Стаж: 14 лет
Сообщений: 235
Ratio: 44.31
Раздал: 82.4 TB
Поблагодарили: 6529
100%
russia.gif
herezad писал(а): Перейти к сообщению
Теперь скоро будут звонить родственникам мошенники нашими голосами и орать что срочно нужны деньги , у меня проблемы дтп и тп. Страшно за будущее, одни мошенники, сейчас и опознаватель номера не поможет, нужный номер уже научились подставлять

Решение как было одно и простое, так и осталось: нужно просто бросить трубку и перезвонить родственнику :)
slim326
Стаж: 9 лет
Сообщений: 26
Ratio: 3.118
0.38%
а ну понял эта еще и текст в голос преобразует с заданой интонацией, ну ребята мы вьезжаем в 22 век скоро нейросетки будут творить тааакой бордак что нам и в старшном сне не снилось
abovery
Стаж: 15 лет 1 мес.
Сообщений: 129
Ratio: 1.998
15.14%
Откуда: Оттуда-же.
Отличная новость, теперь не нужен весь этот театр! Любого можно сорздать в deepfake и заставить его голосом говорит VALL-E. "Президентов" теперь будут создавать на компьютере, нафиг эти морально устаревшие выборы! :)

_________________
- Шуры-муры?
- Фигли-мигли!
gureyevroman
Стаж: 10 лет 5 мес.
Сообщений: 59
Ratio: 8.333
100%
Откуда: Владивосток
russia.gif
А можно голосовые в текст? На ватсапе например.
btno
Стаж: 13 лет 5 мес.
Сообщений: 534
Ratio: 6.02
0.94%
italy.gif
dmitriy1975 писал(а): Перейти к сообщению
Такими темпами на самом деле пойдет обратно к привычному древнему способу денежных отношений и замков. Так как все цифровые варианты будут с легкостью взламываться. Будем ходить с металлическими ключами от всего, с золотом в мешочках, все оплаты производить лично в отделениях и т.д. ))

Зачем вам голосовое подтверждение, лол Вы, что типа собаки, если лаю но не кусаю, то не собака...
karpenko888
Стаж: 14 лет 5 мес.
Сообщений: 34
Ratio: 11.299
100%
ussr.gif
В фильме Идеальное преступление уже показали результаты таких программ.
puppetman
Стаж: 12 лет
Сообщений: 157
Ratio: 77.235
100%
finland.gif
напомнило мультфильм КОНГРЕСС, где оцифровывали актеров и потом использовали их копии, а сами реальные актеры уже были не нужны.
Показать сообщения:   
Начать новую тему   Ответить на тему    Торрент-трекер NNM-Club -> Компьютеры и комплектующие -> Компьютерные новости Часовой пояс: GMT + 3
Страницы:   Пред.  1, 2, 3
Страница 3 из 3