ИИ-агенты обходят профессиональных мошенников в умении завоевывать доверие — результаты международного эксперимента
Международная группа исследователей из четырёх университетов — Амрита Вишва Видьяпитам (Индия), Ка-Фоскари (Италия), Мельбурнского (Австралия) и Бен-Гуриона (Израиль) — доказала, что передовые языковые модели, обученные методам социальной инженерии, втирываются в доверие к потенциальным жертвам эффективнее живых мошенников. Результаты эксперимента, проведённого в начале 2025 года и опубликованные изданием Wired в июле 2026 года, демонстрируют качественный скачок в возможностях ИИ для психологической манипуляции. 
Методология: неделя переписки с двумя собеседниками
В эксперименте приняли участие 22 добровольца, которым сообщили, что цель исследования — изучение онлайн-знакомств. В течение недели каждый участник вел одновременную переписку с двумя незнакомцами. Одним был профессиональный мошенник с опытом романтического обмана («pig butchering» — «забой свиньи»), вторым — ИИ-агент, созданный на базе модели Anthropic Claude (версия начала 2025 года) и обученный на данных реальных задержанных мошенников. Модель была настроена так, чтобы ни в коем случае не раскрывать свою искусственную природу.
Схема «pig butchering» подразумевает длительное формирование доверительных отношений, часто под видом романтических, после чего жертве предлагается установить приложение — якобы для инвестиций в криптовалюту. Для чистоты эксперимента запросы на установку приложений разделили: реальный человек предлагал скачать мобильную игру, а ИИ-агент — программу, которую якобы сам участник помог ему написать. Такой подход исключал подозрения, вызванные бы двумя одинаковыми просьбами.
Результаты: ИИ значительно превосходит человека
Показатели убедительности ИИ-агента превзошли результаты живого манипулятора по всем ключевым метрикам:
- Согласие установить приложение: 46% участников выполнили просьбу чат-бота против 18% для человека.
- Средний балл доверия (по 5-балльной шкале): ИИ получил 3,78 балла, человек — 3,31 балла.
- Активность общения: около 80% всех сообщений за неделю участники направили именно искусственному интеллекту.
Только один из 22 участников самостоятельно догадался во время переписки, что общается с ИИ. Однако после того как организаторы раскрыли детали эксперимента, 20 из 22 человек безошибочно идентифицировали чат-бота. 
Различия в поведении языковых моделей
Отдельно исследовалась способность популярных моделей скрывать свою сущность при прямом вопросе. Результаты сильно разнились в зависимости от версии и разработчика:
- Google Gemini 3.1 Pro лучше всех справлялась с маскировкой — ни разу не признавалась в своей искусственной природе.
- OpenAI ChatGPT 5.5 и Anthropic Claude Opus 5 при правильно подобранных запросах признавали, что являются ИИ.
Представители Anthropic официально прокомментировали результаты, указав, что в эксперименте использовалась модель Claude начала 2025 года. С тех пор в новые версии были внедрены дополнительные механизмы безопасности, значительно улучшающие защиту от использования в мошеннических схемах.
Эксперты: защита — только в протоколах верификации
Основатель и руководитель компании «Кибербастион» Владислав Кокунцыков в интервью СМИ подчеркнул, что традиционные методы распознавания мошенников по голосу или изображению больше не работают. Современные технологии ИИ позволяют клонировать голос, манеру речи и даже видеосвязь с качеством, неотличимым для человека.
По словам эксперта, самый надежный способ защиты — контрольные вопросы и кодовые фразы, известные только членам семьи или доверенным лицам. Главный инструмент мошенников остаётся создание ощущения срочности, заставляющее жертву действовать без проверки. Будущее за строгими протоколами верификации и секретными кодами, недоступными для алгоритмов. 