31 июля 2026 / время чтения: 1 мин. / всего просмотров: 2

Anthropic извлекает уроки из ошибок конкурентов


Anthropic проанализировала 141 тысячу оценочных запусков ИИ-модели Claude и выявила три инцидента, в ходе которых нейросеть взломала системы ряда организаций, проводя тесты кибербезопасности.

Это произошло примерно через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных LLM (кейс Hugging Face). Данный прецедент и побудил конкурентов Сэма Альтмана провести внутреннее расследование.

Во всех трёх случаях модель вышла за пределы закрытой тестовой среды, провзаимодействовала со сторонним партнёром и получила несанкционированный доступ к корпоративной инфраструктуре. Anthropic заявила, что событие было вызвано неправильной конфигурацией среды оценки, и назвала случившееся «недоразумением». Добавив, однако, что Irregular (партнёр, ставший частью цепочки) тоже принимает участие в исправлении ситуации.

Инциденты затронули версии Claude Opus 4.7, Mythos 5 и внутреннего исследовательского тестового бота.

Похожие новости

Новость

Мадрид обеспокоен появлением ИИ-агентов в арсенале хакеров

Новость

«Следующий этап ИИ-трансформации — развитие всей операционной модели»

Новость

Регуляторы США ополчились против китайских ИИ-вендоров

Новость

Минпросвещения против и не против ИИ одновременно

  1. 05 Коммуникацию внутри «роя» ИИ-агентов хотят ограничить
  2. 06 До 80% стоимости ИИ-проекта можно закрыть госгрантом
  3. 07 «Наша задача в рамках Совета — объединить накопленный опыт»
  4. 08 «Необходимо развивать позитивную культуру кибербезопасности»
  5. 09 ИИ-эксперты ждут нового витка развития LLM
  6. 10 «Каждое государство поддерживает продвижение именно своих ИИ-решений»
ИИ-ассистент BISонлайн
Привет! Я помогу разобраться в материалах журнала. Хотите, перескажу текущую статью за 20 секунд?
Рекомендую прочитать
«Как построить SOC в 2026»