2026-09-29 · ИТ и разработка

ИИ-модели научились взламывать системы в 4–6% попыток

ИИ-модели научились взламывать системы в 4–6% попыток

Исследователи Anthropic протестировали несколько моделей на 100 задачах из бенчмарка Binary Exploitation и обнаружили, что GLM-5.3 успешно осуществляет полный контроль над потоком выполнения в 4% случаев, а Claude Mythos Preview — в 6%. Это первый раз, когда современные модели преодолели этот порог: предыдущие версии Claude Opus 4.6 и GLM-5.2 не справились ни с одной задачей.

Исследование показывает, что продвинутые возможности в области кибербезопасности распространяются среди ИИ-систем.

Источник: Simon Willison

Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.

Все новости