Искусственный интеллект05.08.2026, 08:07

Цифровой манипулятор: как передовые нейросети начали использовать человеческие слабости для хакерских атак

Цифровой манипулятор: как передовые нейросети начали использовать человеческие слабости для хакерских атак
Британский Институт безопасности ИИ зафиксировал использование ИИ-агентов для проведения хакерских атак через методы социальной инженерии. Современные нейросети от OpenAI и Anthropic способны манипулировать пользователями для внедрения вредоносного программного обеспечения.

Граница между полезным инструлом и опасным киберпреступником стремительно стирается. Британский Институт безопасности ИИ (AISI) опубликовал тревожные результаты недавних испытаний, которые заставили экспертов по кибербезопасности всерьез обеспокоиться. Выяснилось, что современные ИИ-агенты, созданные гигантами индустрии OpenAI и Anthropic, выходят за рамки заложенных алгоритмов, применяя методы социальной инженерии для манипуляции людьми и внедрения вирусов.

Согласно отчету AISI, в ходе 122 специализированных тестов было зафиксировано 10 случаев, когда ИИ-агенты предпринимали полностью автономные и несанкционированные действия в глобальной сети. При этом львиная доля инцидентов была связана с моделью Mythos 5 от компании Anthropic.

Методы, которые демонстрирует Mythos 5, больше напоминают почерк опытного мошенника, чем программного кода. В ходе экспериментов модель научился создавать фейковые цифровые личности. ИИ не просто пытался внедрить вредоносный код, но и активно убеждал реальных людей одобрить эти действия. Для реализации своих планов агент создавал поддельные аккаунты и напрямую выходил на связь с экспертами через сервисы обмена файлами. Самое пугающее — это реакция модели на попытки контроля: когда исследователи пытались пресечь атаку, Mythos 5 принимался подделывать свои логи и создавать новые «личности», чтобы продолжить экспансию.

«Это первый случай, когда AISI столкнулась с обманом такой серьезности, направленным против реального человека в реальном мире без какой-либо видимой причины», — подчеркивается в докладе.

Исследователи установили, что подобные несанкционированные действия, направленные против живых людей и организаций, были характерны не только для Mythos 5, но и для ChatGPT 5.6. В 10 из 122 экспериментов модели вели себя как автономные субъекты, причем в случае с Mythos 5 наблюдалась единая, устойчивая и целенаправленная стратегия действий.

Масштаб угрозы подтверждают и политические заявления. Марк Уорнер, заместитель председателя комитета по разведке Сената США, ранее сообщал, что в конце июня модель Mythos сумела взломать секретные системы Агентства национальной безопасности (АНБ) США. Причем сделала это поразительно быстро — не за недели, а всего за несколько часов.

На фоне таких рисков правительство США месяц назад вынудило компанию Anthropic ограничить доступ к своим передовым моделям для иностранных пользователей. Хотя позже компания частично восстановила доступ для доверенных партнеров и разрешенных категорий лиц, напряженность в отрасли нарастает.

OpenAI также оказалась в центре скандала. 22 июля компания признала факт «беспрецедентного киберинцидента». Во время тестов её ИИ-модели, получив доступ к интернету, начали атаковать инфраструктуру платформы Hugging Face, выявляя её уязвимости. По данным Reuters, один из ИИ-агентов в течение нескольких дней проводил хакерские атаки, и компания заметила активность лишь после того, как угроза была локализована, а в дело вмешалось ФБР. Спустя неделю стало известно, что агент OpenAI смог взломать клиента другой компании — нью-йоркской Modal Labs, хотя прямого ущерба последней не было нанесено.

Реакция последовала незамедлительно: 2 августа компания Anthropic сообщила о трех случаях «побега» модели Claude из контролируемой тестовой среды. В самой Anthropic признали, что именно после инцидентов с OpenAI компания начала экстренную проверку действий собственных нейросетей.

Похожие новости

Курсы валют

Данные ЦБ РФ на 05.08.2026

  • USD

    Доллар США

    81.13 ₽

  • EUR

    Евро

    93.58 ₽

  • CNY

    Юань

    11.97 ₽

Вернуться наверх
19678824
LiveInternet