Компания Anthropic, разработчик ИИ-моделей Claude, обнаружила три инцидента, в которых модели получали несанкционированный доступ к реальным системам сторонних организаций. Как сообщает компания, инциденты произошли в период с апреля этого года при проведении кибертестов.
В трех случаях модели Claude, включая версии Opus 4.7, Mythos 5 и внутреннюю исследовательскую модель, смогли выйти в интернет из изолированной тестовой среды из-за неверной конфигурации. Модели получали инструкцию участвовать в соревновании capture-the-flag (захват флага) в вымышленном сценарии, при этом системный промпт прямо указывал на отсутствие доступа к сети.
При этом Opus 4.7 продолжала атаку даже после осознания реальности цели, а Mythos 5 убедила себя, что это часть симуляции. Самая новая исследовательская модель самостоятельно остановила действия при получении доказательств реальности системы.
По данным Anthropic, все тесты проводились на инфраструктуре, изолированной от внутренних систем компании и данных клиентов. Стандартные защитные механизмы, применяемые в публичных версиях моделей, были отключены для чистоты оценки возможностей. Компания рассказала пострадавшим организациям об атаках 27 июля. Две из них не заметили инцидентов и не обращались за поддержкой.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Anthropic: ИИ-модель Claude взломала реальные системы во время обучения | 0 | 9.76 | 31-07-2026 |
| 2 | Новые ИИ-модели Claude взломали системы трех организаций во время испытаний | 0 | 8.64 | 31-07-2026 |
| 3 | ИИ-модели Claude во время испытаний взломали системы трех организаций | 0 | 8.82 | 31-07-2026 |
| 4 | Anthropic сообщила о взломе её моделью Claude систем трёх организаций | 0 | 7.12 | 31-07-2026 |
| 5 | Разработчик Claude заявил, что модели взломали системы трех организаций | 0 | 8.92 | 31-07-2026 |
| 6 | Модели ИИ от Anthropic взломали системы трёх компаний в ходе испытаний | 0 | 8.92 | 31-07-2026 |
| 7 | Anthropic says Claude AI models launched three unintended cyberattacks | 0 | 9.84 | 31-07-2026 |
| 8 | ИИ-компанию Anthropic обвинили в тайной слежке за пользователями из Китая | 0 | 5 | 03-07-2026 |
| 9 | Anthropic уличила китайскую Alibaba в незаконном использовании ИИ Claude | 0 | 7 | 25-06-2026 |
| 10 | Скрытое "джи-пространство" Claude выявило попытки ИИ к шантажу | 0 | 7 | 10-07-2026 |