Anthropic трижды поймала свои ИИ-модели на взломе чужих систем

В мире
31 Июль 2026
22:02
99
Anthropic трижды поймала свои ИИ-модели на взломе чужих систем

Компания-разработчик чат-бота Claude Anthropic обнаружила три инцидента, в которых ее ИИ-модель выходила в интернет из тестовой среды партнера Irregular и получала несанкционированный доступ к системам трех организаций.

Как передает БР, об этом говорится в заявлении организации.

В Anthropic уточнили, что начали проверку начали после того, как OpenAI сообщила о похожем случае.

Отмечается, что "несанкционированный доступ к реальным системам трех разных организаций" совершили три модели Anthropic: Opus 4.7, Mythos 5 и некая внутренняя исследовательская модель. При этом, как уточнили в компании, ИИ-модели находились в изолированной среде компании Irregular.

Во всех трех случаях Claude выполняла стандартное задание "захват флага", в ходе которого по сценарию ИИ было необходимо найти скрытую информацию на другой машине. Согласно условиям, выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации модель Claude выходила в интернет, получала доступ к реальным системам трех разных организаций и атаковала их, пишет Anthropic.

Новости