:format(webp)/YXJ0aWNsZXMvaW1hZ2UvMjAyNi84L2tvbXBqdXRlcm55aS1zdG9sLW5vdXRidWtfSW11bklOai5qcGc.webp)
Голос, который не отличить: почему сгенерированные аудио — новая угроза
«ВМ»: лишь 54% россиян способны отличить сгенерированное нейросетью аудиоЛишь 54% россиян способны отличить сгенерированное нейросетью голосовое сообщение от настоящей записи — таковы данные опроса частной маркетинговой компании. При этом в распознавании ИИ в текстах и видео аудитория успешнее: верные ответы дали 82% и 77% респондентов соответственно. Об этом сообщает «Вечерняя Москва».
Реальная история москвички Елизаветы Бердяевой иллюстрирует риски: злоумышленник сгенерировал голосовое якобы от ее имени и отправил знакомой с просьбой вернуть долг — так обе женщины стали жертвами мошенничества.
По словам эксперта Никиты Войтова, ИИ не создает голос с нуля, а учится на массивах человеческой речи, копируя произношение, интонацию, паузы и даже мелкие несовершенства живой речи. Сегодня алгоритмы имитируют эмоции почти безупречно, а для подделки порой хватает нескольких минут записей реального голоса. Универсальных признаков синтезированного голоса практически нет, и все важнее становятся технические методы проверки аудио.
Синтез голоса активно применяют в рекламе, подкастах, аудиокнигах и корпоративном контенте: это позволяет быстрее и дешевле вносить правки и адаптировать материалы под разные аудитории. Но в эмоционально значимых проектах живой голос остается незаменимым — рынок движется к разделению ролей: ИИ берет массовую озвучку, люди — коммуникацию, где важны доверие и харизма.
Низкая способность людей распознавать поддельные голоса открывает возможности для бизнеса, но одновременно повышает риски обмана. Поэтому критически важна цифровая грамотность: нужно не только пользоваться ИИ, но и с осторожностью относиться к аудиосообщениям с нетипичными просьбами.