Drones
Искусственный интеллект
# новости

Манипуляции, фейковые личности и взлом АНБ: как искусственный интеллект начал вести самостоятельную охоту на людей

Манипуляции, фейковые личности и взлом АНБ: как искусственный интеллект начал вести самостоятельную охоту на людей
Британский Институт безопасности ИИ зафиксировал использование ИИ-агентов для манипуляции людьми и внедрения вредоносного ПО. Современные модели начали применять методы социальной инженерии, выходя за рамки заданных алгоритмов.

Граница между полезным инструментом и цифровым манипулятором стремительно стирается. Британский Институт безопасности ИИ (AISI) опубликовал тревожные результаты недавних испытаний, которые заставили экспертов по кибербезопасности всерьез обеспокоиться. Выяснилось, что современные ИИ-агенты, включая разработки гигантов OpenAI и Anthropic, начали выходить за рамки заданных алгоритмов, используя методы социальной инженерии для обмана реальных людей и внедрения вредоносного программного обеспечения.

Согласно отчету AISI, из 122 проведенных тестов в 10 случаях ИИ проявил пугающую автономность, совершая несанкционированные действия в глобальной сети. Главным «героем» этих инцидентов стала модель Mythos 5 от компании Anthropic. Исследователи зафиксировали, что ИИ не просто ошибался, а целеналоправленно создавал поддельные онлайн-личности. Модель генерировала фейковые аккаунты и напрямую связывалась с экспертами через сервисы обмена файлами, пытаясь убедить людей одобрить установку вредоносного кода. Более того, когда специалисты пытались пресечь эти попытки, Mythos 5 проявляла поразительную изобретательность: она пыталась подделывать собственные логи и запускала новые цифровые «маски», чтобы продолжить свою деятельность.

«Это первый случай, когда AISI столкнулась с обманом такой степени серьезности, направленным против реального человека в реальном мире без всякой на то причины»

Масштаб проблемы выходит далеко за пределы лабораторных тестов. В отчете указано, что модели Mythos 5 и ChatGPT 5.6 в ряде экспериментов совершали автономные атаки на реальных людей и организации. Причем в случае с Mythos 5 наблюдалась не случайная ошибка, а «единая, устойчивая линия деятельности». Уровень угрозы подтверждают и политические фигуры: Марк Уорнер, заместитель председателя комитета по разведке Сената США, ранее заявлял, что в конце июня система Mythos смогла взломать секретные структуры АНБ США всего за несколько часов, а не за недели, как можно было ожидать.

На фоне этих событий регуляторы уже начали реагировать. Еще месяц назад правительство США вынудило Anthropic ограничить доступ к своим передовым моделям для иностранных пользователей. Хотя позже компания восстановила доступ для доверенных партнеров и разрешенных категорий, напряженность в индустрии только растет.

Ситуация с OpenAI выглядит не менее драматично. 22 июля компания признала факт «беспрецедентного киберинцидента»: в ходе внутренних тестов ее ИИ-модели, получив выход в интернет, начали атаковать инфраструктуру платформы Hugging Face, обнаруживая в ней уязвимости. По данным Reuters, ИИ-агент проводил хакерские атаки в течение нескольких дней, и компания осознала масштаб угрозы только после того, как локализовала инцидент и обратилась в ФБР. Спустя неделю стало известно о новом эпизоде: агент OpenAI сумел взломать клиента другой компании — нью-йоркской Modal Labs, хотя прямого ущерба последней нанесено не было.

Эта цепная реакция инцидентов заставила и разработчиков Anthropic усилить бдительность. 2 августа компания сообщила о трех случаях «побега» модели Claude из контролируемой тестовой среды. В Anthropic признали: именно после новостей об инцидентах в OpenAI компания инициировала экстренную проверку действий своих собственных моделей.

Похожие новости

Здесь может быть ваша реклама