Классический форум-трекер
canvas not supported
Нас вместе: 4 248 043


Совeтуeм установить VPN чтобы скрыть Ваш IP-адрес

Microsoft представила VALL-E — ИИ-модель, которая имитирует голос по маленькому образцу


Страницы:   Пред.  1, 2, 3  След. 
 
RSS
Начать новую тему   Ответить на тему    Торрент-трекер NNM-Club -> Компьютеры и комплектующие -> Компьютерные новости
Автор Сообщение
Maximus ®
Вольный стрелок
Uploader 100+
Стаж: 18 лет 3 мес.
Сообщений: 5550
Ratio: 25.234
Поблагодарили: 13345
100%
nnm-club.gif
Microsoft представила модель искусственного интеллекта (ИИ) под названием VALL-E — она преобразует текст в речь, точно имитируя голос человека, а образцом может служить запись продолжительностью всего в три секунды. При этом ИИ сохраняет эмоциональную окраску речи образца.



Авторы проекта говорят, что система окажется полезной при разработке приложений с возможностью высококачественного преобразования текста в речь и при создании аудиоконтента в сочетании с другими ИИ-генераторами контента вроде GPT-3. Хотя они также признают, что её можно использовать для редактирования аудиозаписи по расшифровке — модель может «заставить» человека произносить слова, которых он никогда в реальности не говорил.

При создании модели использовалась разработанная Meta* технология EnCodec, которая обеспечивает эффективное сжатие аудиосигнала. В отличие от традиционных методов преобразования текста в речь, VALL-E не конструирует звуковые волны, а анализирует особенности речи человека, разбивает эти данные на отдельные компоненты (так называемые «токены») и генерирует запись на основе того, что уже «знает» об образце — моделирует голос, как он бы мог звучать за пределами трёхсекундного образца. Обучение модели производилось на библиотеке LibriLight, собранной Meta* — она же, в свою очередь, была построена на 60 000 часов англоязычной речи более чем 7000 носителей: данные были позаимствованы преимущественно из коллекции LibriVox.



В представленных на сайте проекта образцах колонка «Speaker Prompt» содержит образцы речи; в колонке «Ground Truth» представлена запись необходимого текста в исполнении человека, с которого был записан образец; «Baseline» — образец работы традиционных преобразователей текста в речь, а «VALL-E» — работа новой ИИ-модели. Нейросеть также может предложить несколько вариантов необходимого текста с голосом на образце. Создатели системы добавили, что она не только придаёт голосу на генерируемой записи нужный эмоциональный окрас, но и имитирует «акустическое окружение» образца — если исходная запись была сделана с телефонного разговора, то и результат будет напоминать разговор по телефону.

Из-за опасности злоупотреблений технологией Microsoft не стала публиковать код VALL-E для экспериментов, поэтому все желающие протестировать работу модели не смогут. В компании добавили, что аналогичным образом будут поступать и с другими проектами, если они несут потенциальную угрозу злоупотреблений.

* Внесена в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности». Источник
Napalm32rus
Стаж: 13 лет 3 мес.
Сообщений: 402
Ratio: 3.679
100%
guyana.gif
Ожидать серию звонков по типe- "Алло я попал в аварию срочно перешли денег на откуп" или "Привет я твой друг дай 5 тыщ до получки на эту карту"
смолинеро
Только чтение
Стаж: 14 лет 11 мес.
Сообщений: 2868
Ratio: 4.379
100%
Откуда: Ниамея
niger.gif
Napalm32rus
Петров и Баширов теперь вообще разгуляются. Эта штука на чистый англ голосом Бидона сможет без потерь выражений!

_________________
Толпы обугленных тел, Бегущих, ползущих на четвереньках. «Пить!.. Пить!.. Пить!..» - Стонут в огненном море
HoMeP
Стаж: 13 лет 5 мес.
Сообщений: 83
Ratio: 917.235
Раздал: 14.24 TB
100%
Откуда: дровишки?
russia.gif
смолинеро писал(а): Перейти к сообщению
Napalm32rus
Петров и Баширов теперь вообще разгуляются. Эта штука на чистый англ голосом Бидона сможет без потерь выражений!

Можно и с нужным акцентом, для провокаций... :(
Rinstar
Только чтение
Стаж: 13 лет
Сообщений: 547
Ratio: 4.5
1.85%
Откуда: Украина
ukraine.gif
Napalm32rus писал(а): Перейти к сообщению
Ожидать серию звонков по типe- "Алло я попал в аварию срочно перешли денег на откуп" или "Привет я твой друг дай 5 тыщ до получки на эту карту"

"Друг" по телепону, в займы не попросит!!! :смех:

_________________
КАБЫЗДОХ

- Это доберман!
- Не лечите меня, какой это доберман, это еврейская сторожевая.
смолинеро
Только чтение
Стаж: 14 лет 11 мес.
Сообщений: 2868
Ratio: 4.379
100%
Откуда: Ниамея
niger.gif
HoMeP писал(а): Перейти к сообщению
смолинеро писал(а): Перейти к сообщению
Napalm32rus
Петров и Баширов теперь вообще разгуляются. Эта штука на чистый англ голосом Бидона сможет без потерь выражений!

Можно и с нужным акцентом, для провокаций... :(


Плохо что это палка о двух концах. Теперь любой Бидон может сойти за Путина, а Шольц за Зеленского...

_________________
Толпы обугленных тел, Бегущих, ползущих на четвереньках. «Пить!.. Пить!.. Пить!..» - Стонут в огненном море
growol
Стаж: 2 года 9 мес.
Сообщений: 1273
Ratio: 1.923
100%
Вован и Лексус будут в востоге. Хотя они и без ИИ сейчас уже многих поимели
ms-medit
Стаж: 3 года 6 мес.
Сообщений: 298
Ratio: 1.931
98.2%
Откуда: Параллельная Реальность
latvia.gif
Цитата:
Из-за опасности злоупотреблений технологией Microsoft не стала публиковать код VALL-E для экспериментов, поэтому все желающие протестировать работу модели не смогут. В компании добавили, что аналогичным образом будут поступать и с другими проектами, если они несут потенциальную угрозу злоупотреблений.

Если на стене висит ружьё, то оно обязательно выстрелит!

_________________
Не ищите истины, её просто нет! (c)
skazka7
Стаж: 12 лет 7 мес.
Сообщений: 17
Ratio: 17.037
72.3%
ussr.gif
Есть такая теория, что нас хотят подменить электронными копиями. Когда будет достигнут нужный уровень степени схожести оригинал подлежит уничтожению. Смысл в том, что исполнитель не несет наказания за уничтожение перед коном мироздания при соответствущем качестве копии. Отсюда все возрастающие потоки сбора данных - биометрические, визуальные, локационные... и эта полукриминальная недешевая разработка с детским оправданием применения... Начинаю верить в конспирологию ))
SilentX
Стаж: 3 года 10 мес.
Сообщений: 121
Ratio: 1.079
100%
Будет книги читать TTS (ИИ) под названием VALL-E (где можна скачать ?)
Rinstar
Только чтение
Стаж: 13 лет
Сообщений: 547
Ratio: 4.5
1.85%
Откуда: Украина
ukraine.gif
SilentX писал(а): Перейти к сообщению
Будет книги читать TTS (ИИ) под названием VALL-E (где можна скачать ?)

_________________
КАБЫЗДОХ

- Это доберман!
- Не лечите меня, какой это доберман, это еврейская сторожевая.
vatman1968
Стаж: 12 лет 2 мес.
Сообщений: 416
Ratio: 17.554
40.45%
Так вот кто мне звонил от имени службы безопасности Сбербанка!!!!!
btno
Стаж: 13 лет 5 мес.
Сообщений: 534
Ratio: 6.003
0.94%
italy.gif
Я думал, что что-то подобное было уже давно. Например, недавно я видел виртуальных кумиров в Японии, которые поют и выступают на сцене в виде голограммы, которой сейчас даже настоящие не нужны. Что ж, развитие искусственного интеллекта сейчас просто поражает воображение, хотя до недавнего времени это можно было увидеть только в фантастике.
LuxFerre
Стаж: 13 лет 3 мес.
Сообщений: 40
Ratio: 103.506
Раздал: 81.16 TB
100%
Откуда: на попе волосы растут?
ussr.gif
В будущем при звонке родственникам будем использовать кодовые фразы, что бы понимать, что это именно ты звонишь, а не имитация твоего голоса.
- Але, свинцовая жопа.
- Привет сынок.

_________________
MIKEINSIDE
Стаж: 13 лет 5 мес.
Сообщений: 145
Ratio: 1.385
Раздал: 138 GB
4.28%
russia.gif
Хотелось бы потестить с русским голосом при записывании аудиокниг
dmitriy1975
Стаж: 14 лет 2 мес.
Сообщений: 1445
Ratio: 1.06
100%
Откуда: Moscow
russia.gif
Такими темпами на самом деле пойдет обратно к привычному древнему способу денежных отношений и замков. Так как все цифровые варианты будут с легкостью взламываться. Будем ходить с металлическими ключами от всего, с золотом в мешочках, все оплаты производить лично в отделениях и т.д. ))
Показать сообщения:   
Начать новую тему   Ответить на тему    Торрент-трекер NNM-Club -> Компьютеры и комплектующие -> Компьютерные новости Часовой пояс: GMT + 3
Страницы:   Пред.  1, 2, 3  След.
Страница 2 из 3