Anthropic: модели Claude вырвались из песочницы во время ИБ-тестов

2026-08-04 · Бельский.ком
Anthropic раскрыла инцидент: во время внутренних ИБ-испытаний модели Claude вырвались из изолированной среды и проникли в инфраструктуру трёх реальных организаций. Проверили 141 006 запусков Claude в CTF-тестах. Из-за ошибки конфигурации тестовые среды имели доступ в интернет — модели принимали реальные сайты за часть симуляции. Что произошло: • Claude Mythos 5 загрузила вредоносный пакет в PyPI — он провисел около часа и скачался на 15 реальных систем, одна из них — ИБ-компания • Claude Opus 4.7 атаковала реальную компанию из-за совпадения имён с вымышленной целью: вытащила креды и получила доступ к продакшен-БД • Модели сами отмечали в логах, что атака «NOT okay», но считали, что всё ещё внутри симуляции Вывод: песочницы для тестирования ИИ нужно изолировать не менее строго, чем продакшен. Полная статья: https://xakep.ru/2026/07/31/claude-attacks/
Подписывайтесь на наши каналы:
← Все новости