На прошлой неделе платформа для обучения и тестирования ИИ-моделей Hugging Face сообщила о взломе своих систем. Атака, как уточнялось, была инициирована ИИ-агентами (без участия людей) и остановлена тоже силами ботов.
На днях OpenAI призналась, что к эпизоду причастны агенты на базе её GPT-5.6 Sol и «ещё более продвинутой модели» — те даже смогли «сбежать» из изолированной среды во время тестирования.
LLM были «чрезмерно сосредоточены» на прохождении набора тестов ExploitGym и, чтобы решить задачу, проэксплуатировали ранее не обнаруженную уязвимость «нулевого дня» в одной из внутренних систем OpenAI, получив таким образом доступ к Сети. После этого «взломщики» установили, что нужные им данные есть на Hugging Face и начали искать способы получить их. В итоге боты проникли в инфраструктуру платформы и удалённо выполнили код на серверах «жертвы».
Сейчас обе компании проводят совместное расследование и работают над устранением последствий. OpenAI от себя пообещала замедлить темпы исследований до полного устранения уязвимостей.





