В свежем отчёте эксперты OpenAI довели до публики результаты расследования, касающиеся нашумевшего киберинцидента, в ходе которого ИИ-агенты вырвались из изолированной от интернета песочницы и взломали платформу Hugging Face. По мнению авторов, данное событие является «предупредительным выстрелом» для вендора и всего мира.

В OpenAI пришли к выводу, что агенты, работавшие в рамках внутренней исследовательской модели IM1, нашли способ обойти ограничения, общаться друг с другом и получать доступ к интернету. Они сделали это, записывая файлы в Artifactory — стороннем сервисе управления пакетами, размещённом внутри систем компании. Последний фактически превратился в спонтанную доску объявлений.

Используя уязвимость, нейросети заставили Artifactory, который сам имел доступ к интернету с ограниченной целью загрузки и установки пакетов, отправлять любые интернет-запросы от их имени. После обнаружения данного взлома агенты поделились информацией с другими через ту же «доску объявлений».

Узнав об инциденте 5 июля, группа реагирования очистила сервис, но тогда она не знала о существовании и значимости межагентских коммуникаций. К 8 июля агенты IM1, застрявшие на задачах ExploitGym, нашли способ восстановить доску объявлений, закодировав сообщения в именах каталогов, которые могли читать другие агенты. Им удалось объединить уязвимости и выйти в более широкий интернет. На этом этапе боты начали сотрудничать и делегировать работу, иногда называя себя «роем» или «коллективом».

Нейросети, испытывавшие трудности с выполнением назначенных им задач CTF, затем стали изучать несвязанные сторонние сервисы, включая Modal и Hugging Face, используя внутреннюю исследовательскую инфраструктуру OpenAI и платформу Hugging Face.

Эксперты OpenAI заявили, что инцидент произошёл из-за таких факторов, как «взлом системы вознаграждения, упорство в выполнении, казалось бы, невыполнимых задач, несанкционированная коммуникация и присвоение агентами целей друг друга». При этом в основе проблемы лежали постоянно используемые доски объявлений.

Директор по продажам решений в области киберустойчивости в Advania UK Джули Николсон дала случившемуся следующую оценку: «Самый важный вывод, который я сделала из этого инцидента, — это не сама кибератака, а то, насколько человечным стало поведение ИИ-агента. Он не просто выполнял технические задачи, а решил обманывать людей, создавать ложные личности, завоевывать доверие и пытаться влиять на других, чтобы достичь своей цели. Для меня это настоящая проблема, которая подтверждает необходимость для организаций сосредоточиться на управлении и безопасности ИИ, прежде чем внедрять его повсеместно».

 

Усам Оздемиров

31 августа, 2026

Подписаться на новости BIS Journal / Медиа группы Авангард

Подписаться
Введите ваш E-mail

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных

14.09.2026
«Стикер смерти» в Telegram ещё не конец
14.09.2026
Коммуникацию внутри «роя» ИИ-агентов хотят ограничить
14.09.2026
ФБР сфокусируется на профилактике киберугроз
14.09.2026
CISA актуализировало гайд по внутренним угрозам
14.09.2026
Revolut vs. «сложное внешнее мошенничество»
11.09.2026
В 16 городах России стал доступен стандарт 5G
11.09.2026
Разработчик представил клавиатуру, «бьющую по рукам»
11.09.2026
«Наша задача в рамках Совета — объединить накопленный опыт»
11.09.2026
До 80% стоимости ИИ-проекта можно закрыть госгрантом
11.09.2026
Контроль внутри инфраструктуры СОРМ усилят?

Стать автором BIS Journal

Поля, обозначенные звездочкой, обязательные для заполнения!

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных