Anthropic проанализировала 141 тысячу оценочных запусков ИИ-модели Claude и выявила три инцидента, в ходе которых нейросеть взломала системы ряда организаций, проводя тесты кибербезопасности.

Это произошло примерно через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных LLM (кейс Hugging Face). Данный прецедент и побудил конкурентов Сэма Альтмана провести внутреннее расследование.

Во всех трёх случаях модель вышла за пределы закрытой тестовой среды, провзаимодействовала со сторонним партнёром и получила несанкционированный доступ к корпоративной инфраструктуре. Anthropic заявила, что событие было вызвано неправильной конфигурацией среды оценки, и назвала случившееся «недоразумением». Добавив, однако, что Irregular (партнёр, ставший частью цепочки) тоже принимает участие в исправлении ситуации.

Инциденты затронули версии Claude Opus 4.7, Mythos 5 и внутреннего исследовательского тестового бота.

31 июля, 2026

Подписаться на новости BIS Journal / Медиа группы Авангард

Подписаться
Введите ваш E-mail

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных

17.09.2026
НСПК реализовала оплату смарт-часами
17.09.2026
«Каждая секунда простоя обходится бизнесу в реальные деньги»
16.09.2026
Забытый «пластик» привлекает приставов?
16.09.2026
Банк России представил новый антифрод-протокол
16.09.2026
«Следующий этап ИИ-трансформации — развитие всей операционной модели»
16.09.2026
Хакеры устроили утечку, чтобы наловить «криптокитов»
16.09.2026
Потенциальный запрет на выезд: сначала частники, потом — госслужащие
15.09.2026
Минпросвещения против и не против ИИ одновременно
15.09.2026
«Ростех» настроил оптику на промсектор, авиацию и энергетику
15.09.2026
Интерес к «гибридам» растёт, но on-prem всё ещё царь

Стать автором BIS Journal

Поля, обозначенные звездочкой, обязательные для заполнения!

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных