В свежем отчёте эксперты OpenAI довели до публики результаты расследования, касающиеся нашумевшего киберинцидента, в ходе которого ИИ-агенты вырвались из изолированной от интернета песочницы и взломали платформу Hugging Face. По мнению авторов, данное событие является «предупредительным выстрелом» для вендора и всего мира.

В OpenAI пришли к выводу, что агенты, работавшие в рамках внутренней исследовательской модели IM1, нашли способ обойти ограничения, общаться друг с другом и получать доступ к интернету. Они сделали это, записывая файлы в Artifactory — стороннем сервисе управления пакетами, размещённом внутри систем компании. Последний фактически превратился в спонтанную доску объявлений.

Используя уязвимость, нейросети заставили Artifactory, который сам имел доступ к интернету с ограниченной целью загрузки и установки пакетов, отправлять любые интернет-запросы от их имени. После обнаружения данного взлома агенты поделились информацией с другими через ту же «доску объявлений».

Узнав об инциденте 5 июля, группа реагирования очистила сервис, но тогда она не знала о существовании и значимости межагентских коммуникаций. К 8 июля агенты IM1, застрявшие на задачах ExploitGym, нашли способ восстановить доску объявлений, закодировав сообщения в именах каталогов, которые могли читать другие агенты. Им удалось объединить уязвимости и выйти в более широкий интернет. На этом этапе боты начали сотрудничать и делегировать работу, иногда называя себя «роем» или «коллективом».

Нейросети, испытывавшие трудности с выполнением назначенных им задач CTF, затем стали изучать несвязанные сторонние сервисы, включая Modal и Hugging Face, используя внутреннюю исследовательскую инфраструктуру OpenAI и платформу Hugging Face.

Эксперты OpenAI заявили, что инцидент произошёл из-за таких факторов, как «взлом системы вознаграждения, упорство в выполнении, казалось бы, невыполнимых задач, несанкционированная коммуникация и присвоение агентами целей друг друга». При этом в основе проблемы лежали постоянно используемые доски объявлений.

Директор по продажам решений в области киберустойчивости в Advania UK Джули Николсон дала случившемуся следующую оценку: «Самый важный вывод, который я сделала из этого инцидента, — это не сама кибератака, а то, насколько человечным стало поведение ИИ-агента. Он не просто выполнял технические задачи, а решил обманывать людей, создавать ложные личности, завоевывать доверие и пытаться влиять на других, чтобы достичь своей цели. Для меня это настоящая проблема, которая подтверждает необходимость для организаций сосредоточиться на управлении и безопасности ИИ, прежде чем внедрять его повсеместно».

 

Усам Оздемиров

31 августа, 2026

Подписаться на новости BIS Journal / Медиа группы Авангард

Подписаться
Введите ваш E-mail

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных

31.08.2026
ИИ «решил обманывать людей и создавать ложные личности»
28.08.2026
Reco: Большинство инструментов ИИ работает бесконтрольно
28.08.2026
ВТБ собирает биометрию через своё приложение
28.08.2026
CyberLink. Какие риски приходят вместе с ростом бизнеса
28.08.2026
«Через несколько лет этих карт у россиян практически не останется»
28.08.2026
Цифровой рубль не для «яблочников»?
28.08.2026
Revolut стремится покрыть сектор «еврокрипты»?
27.08.2026
Атака на электростанцию стала тревожным сигналом для CNI
27.08.2026
NIST указал на риски безопасности в многооблачных средах
27.08.2026
TCG — о стандарте квантовой безопасности оборудования

Стать автором BIS Journal

Поля, обозначенные звездочкой, обязательные для заполнения!

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных