Anthropic проанализировала 141 тысячу оценочных запусков ИИ-модели Claude и выявила три инцидента, в ходе которых нейросеть взломала системы ряда организаций, проводя тесты кибербезопасности.

Это произошло примерно через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных LLM (кейс Hugging Face). Данный прецедент и побудил конкурентов Сэма Альтмана провести внутреннее расследование.

Во всех трёх случаях модель вышла за пределы закрытой тестовой среды, провзаимодействовала со сторонним партнёром и получила несанкционированный доступ к корпоративной инфраструктуре. Anthropic заявила, что событие было вызвано неправильной конфигурацией среды оценки, и назвала случившееся «недоразумением». Добавив, однако, что Irregular (партнёр, ставший частью цепочки) тоже принимает участие в исправлении ситуации.

Инциденты затронули версии Claude Opus 4.7, Mythos 5 и внутреннего исследовательского тестового бота.

31 июля, 2026

Подписаться на новости BIS Journal / Медиа группы Авангард

Подписаться
Введите ваш E-mail

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных

31.07.2026
Стартовал приём заявок на премию BISA
31.07.2026
7 млн клиентов ВТБ сдало свою биометрию
31.07.2026
Финское окно интернет-трафика закрывается?
31.07.2026
Использование MAX не будет расходовать пакеты мобильного трафика
31.07.2026
Австралийский цифровой регулятор недоволен «Телеграмом»
31.07.2026
Anthropic извлекает уроки из ошибок конкурентов
30.07.2026
Apple устранила почти три сотни брешей в своих ОС
30.07.2026
Минус ещё два мессенджера в России (?)
30.07.2026
«Яндекс» и Wildberries собираются присоединиться к банкам на рынке MVNO
30.07.2026
С начала года число ИИ-атак выросло втрое

Стать автором BIS Journal

Поля, обозначенные звездочкой, обязательные для заполнения!

Отправляя данную форму вы соглашаетесь с политикой конфиденциальности персональных данных