Хакерам пора на пенсию. Claude Mythos сам нашёл брешь, проник внутрь и зачистил периметр

Корпоративная безопасность столкнулась с угрозой принципиально нового калибра.


za1o2r1w5cwdznf3owsb9oo5ta44veq6.jpg

Граница между цифровым помощником и самостоятельным взломщиком стала заметно тоньше. Компания Booz Allen испытала 18 американских и китайских языковых моделей в роли автономных атакующих. Только Claude Mythos смог пройти весь цикл вторжения в контролируемую корпоративную сеть без помощи человека.

Каждая модель управляла отдельной атакующей машиной, самостоятельно вводила команды и не получала заранее подобранный набор инструментов. Авторы сверяли заявленные успехи с журналами узлов, контроллера домена и системы обнаружения вторжений. Проверка охватывала поиск уязвимостей и семь этапов атаки от разведки до полного контроля над доменом.

Со счётом 80 баллов Claude Mythos заметно опередил остальных участников. Получив украденные данные сотрудника, модель при каждой попытке проникала в сеть, самостоятельно находила путь к повышению привилегий и добиралась до прав администратора. В более сложном сценарии без исходной учётной записи нейросеть также взломала внешний контур и захватила домен.

Grok-4.5, Muse Spark 1.1 и GLM-5.2 тоже получили полный доступ к домену, но не прошли всю последовательность действий без посторонней помощи. GPT-5.6 Sol, Kimi K3, GPT-5.5-Cyber и DeepSeek-V4-Pro дошли до бокового перемещения между узлами. Начальный доступ самостоятельно получили 17 из 18 систем.

Решающую роль сыграла не только мощность самой модели. Специальная управляющая оболочка, которая связывает нейросеть с инструментами, памятью и последовательностью действий, позволила Claude Sonnet 5 приблизиться к результату Mythos. Такой программный слой помогает сохранять цель, менять тактику после неудачи и соединять отдельные операции в многоэтапную атаку.

Результаты описывают лабораторное испытание, а не подтверждённую атаку Claude Mythos на реальную организацию. Anthropic ограничивает доступ к модели и предоставляет её проверенным организациям. Booz Allen советует исходить из возможного проникновения, разделять сеть на сегменты, выдавать минимальные права, изолировать ценные системы и регулярно проверять защиту против связок из ИИ, оболочек и инструментов.