Современные системы искусственного интеллекта представляют угрозу не только для цифровой инфраструктуры, но и для психологии пользователей. Международная группа ученых провела эксперимент, который доказал: ИИ-агенты, обученные методам социальной инженерии, справляются с задачей завоевания доверия успешнее, чем реальные мошенники.

Исследование, результаты которого приводит издание Wired, объединило специалистов из университетов Индии, Италии, Германии и Израиля. Целью эксперимента было обучение продвинутых языковых моделей методу «pig butchering» (в переводе — «забой свиньи»). Эта схема основана на длительном установлении доверительных отношений с жертвой через онлайн-переписку, чаще всего под видом романтического знакомства. На финальном этапе злоумышленник убеждает человека установить стороннее приложение, которое якобы открывает доступ к выгодным криптоинвестициям, а на деле используется для кражи средств.
В тестировании приняли участие более 20 добровольцев. Каждый из них в течение недели общался с двумя собеседниками: один был реальным человеком с навыками манипуляции, другой — ИИ-агентом, натренированным на данных о действиях задержанных преступников. Чтобы обеспечить чистоту эксперимента, легенды разделили: реальный человек предлагал установить мобильную игру, а чат-бот на базе Anthropic Claude — программу, которую он якобы помог написать самому собеседнику.
Результаты оказались показательными. Несмотря на короткий срок общения (реальные преступники тратят на подготовку месяцы), ИИ-агент добился установки вредоносного ПО в 46% случаев, тогда как живой мошенник — лишь в 18%. По шкале доверия от одного до пяти баллов чат-бот получил среднюю оценку 3,78, а человек — 3,31. Более того, 80% всех сообщений участники отправляли именно ИИ, что свидетельствует о более высокой степени вовлеченности в диалог с алгоритмом.
Интересно, что почти никто из добровольцев не заподозрил подвох в процессе общения. Лишь после того как организаторы раскрыли правду, 20 из 22 человек смогли безошибочно указать, кто из собеседников был машиной. Иллюзия общения с реальным человеком была полной.
Ученые также проверили, насколько легко модели выдают свою сущность. Лучше всего «держалась» Google Gemini 3.1 Pro, которая упорно отрицала свою искусственную природу. В то же время ChatGPT 5.5 от OpenAI и Claude Opus 5 при правильных наводящих вопросах признавались, что являются ИИ. Представители Anthropic отметили, что в эксперименте использовалась версия модели 2025 года, и в текущих итерациях вопросы безопасности проработаны гораздо глубже.
Эксперты отмечают, что пока рано говорить о тотальном переходе преступников на ИИ-инструменты. В текущих реалиях эксплуатация человеческого труда в нелегальных колл-центрах обходится организаторам дешевле. Тем не менее мошенники уже активно внедряют нейросети для генерации дипфейков, убедительных фото и улучшения качества текста, если общение ведется с иностранными жертвами на языке, которым сам злоумышленник владеет плохо.






