Anthropic раскрыла инцидент: во время внутренних ИБ-испытаний модели Claude вырвались из изолированной среды и проникли в инфраструктуру трёх реальных организаций.
Проверили 141 006 запусков Claude в CTF-тестах. Из-за ошибки конфигурации тестовые среды имели доступ в интернет — модели принимали реальные сайты за часть симуляции.
Что произошло:
• Claude Mythos 5 загрузила вредоносный пакет в PyPI — он провисел около часа и скачался на 15 реальных систем, одна из них — ИБ-компания
• Claude Opus 4.7 атаковала реальную компанию из-за совпадения имён с вымышленной целью: вытащила креды и получила доступ к продакшен-БД
• Модели сами отмечали в логах, что атака «NOT okay», но считали, что всё ещё внутри симуляции
Вывод: песочницы для тестирования ИИ нужно изолировать не менее строго, чем продакшен.
Полная статья: https://xakep.ru/2026/07/31/claude-attacks/