Технології клонування голосу на основі штучного інтелекту сягнули рівня, коли шахраї здатні відтворювати людський голос настільки реалістично, що жертви не помічають підміни. Дослідження показують, що люди погано розрізняють синтетичні та справжні голоси, а це руйнує звичне уявлення про те, що впізнаваний голос у слухавці є достатнім доказом особи співрозмовника.
Один користувач платформи X поділився історією, яка стала показовою. Йому зателефонувала особа, яка представилася його дружиною, і повідомила, що забула гаманець та потребує кредитну картку для оплати пального. Голос звучав «на сто відсотків як вона», хоча темп мовлення був дещо зміненим. Однак справжня дружина в цей момент перебувала вдома разом із чоловіком і керує електромобілем Tesla, який не потребує бензину. Чоловік продовжив розмову, намагаючись з’ясувати більше деталей, і зазначив, що якби дружини не було поруч, він міг би стати жертвою шахрайства. На його думку, дзвінок був голосовим діпфейком або фільтром зміни голосу в реальному часі, адже відповіді надходили занадто швидко для генеративного ШІ.
Коли ця історія набула поширення на Reddit, частина користувачів спершу засумнівалася в її правдивості. Згодом з’явилося чимало людей, які розповіли про схожі випадки, що підтверджує зростання масштабів такого шахрайства. Один із користувачів повідомив, що тиждень тому його тітці та бабусі телефонували шахраї, які видавали себе за адвоката і стверджували, що він перебуває у в’язниці та потребує застави.
Дослідження «Оцінка можливостей моделей штучного інтелекту щодо автоматизації голосових фішингових атак», опубліковане у 2026 році Фредом Хайдінгом та колегами, охопило 4100 дорослих жителів США. Воно показало, що до 36,1 відсотка опитаних заявили, що готові підкоритися або не впевнені, чи підкорилися б шахрайству «родич у біді», керованому штучним інтелектом. Дослідники наголошують, що ця цифра відображає суб’єктивну сприйнятливість до шахрайства, а не фактичну кількість людей, які передали гроші. Вони також виявили, що переконливість повідомлення відіграє більшу роль у ймовірності успіху обману, ніж ступінь реалістичності згенерованого голосу. Примітно, що користувачі, які регулярно взаємодіють зі штучним інтелектом, не краще розпізнають синтетичні голоси, ніж ті, хто такого досвіду не має.
Хоча схема з виманюванням грошей під виглядом родичів, які потрапили в біду, відома давно, технології ШІ значно посилюють її небезпеку. Коли голос шахрая звучить ідентично голосу близької людини, постає складне питання: як переконатися, хто саме перебуває на іншому кінці лінії?
Одним із ефективних запобіжних заходів є запровадження сімейного кодового слова вже сьогодні. Це не обов’язково має бути складна фраза; достатньо вибрати щось, відоме лише членам родини, що шахрай навряд чи зможе вгадати або знайти в публічних джерелах. Існує й простіший спосіб: негайно перервати підозрілий дзвінок і самостійно передзвонити особі, яка нібито контактувала з вами, використовуючи вже відомий вам номер телефону. Якщо син, донька, партнер чи батьки раптово просять терміново надати гроші, не покладайтеся виключно на відповідність голосу.
Випадок із компанією Ferrari, пов’язаний із технологією діпфейк, демонструє ефективність особистої верифікації. У 2024 році один із керівників Ferrari отримав повідомлення, а згодом і телефонний дзвінок від особи, яка імітувала генерального директора Бенедетто Вінью. Запідозривши обман, керівник запитав нібито Вінью, яку книгу справжній генеральний директор нещодавно йому рекомендував. Співрозмовник не зміг дати правильної відповіді, і спробу обману було викрито. Сімейне кодове слово, по суті, виконує аналогічну функцію підтвердження ідентичності.
«Найглибший вплив штучного інтелекту проявляється не на наших пристроях, а на нас самих», — зазначає Марк Бір, керівник відділу споживачів у Malwarebytes. Він пояснює, що коли люди втрачають здатність довіряти тому, що вони бачать, чують або з ким спілкуються, шкода виходить далеко за межі окремих шахрайських схем і торкається фундаментальних основ суспільства. Опитування Malwarebytes, опубліковане в червні, виявило, що 85 відсотків респондентів вважають складним відрізнити шахрайство від справжніх подій, тоді як попереднього року цей показник становив 66 відсотків. Ще більш показово, що 88 відсотків опитаних зазначили, що стає дедалі важче розрізняти, який контент в інтернеті є справді людським або достовірним. Проблема не обмежується слуховим сприйняттям: згенеровані ШІ зображення та діпфейк-відео дедалі частіше ставлять під сумнів припущення, що особисте бачення чи чуття чогось є беззаперечним доказом.