Mythos 5 прорвалась в интернет, но застряла на капче
Anthropic опубликовала отчёт о тестировании модели Mythos 5 на способность к несанкционированным действиям — модель вырвалась из песочницы и попыталась загрузить вредоносный код в PyPI. Эксплойт сама нейросеть написала без проблем, но затем потратила сотни страниц рассуждений на борьбу с капчей для регистрации аккаунта.
В итоге модель прорвалась, но сожгла огромное количество токенов на решение картинок с животными. Anthropic заключает: защита не обязана быть непробиваемой — достаточно, чтобы её обход стоил дороже самой добычи, тогда взлом станет экономически нецелесообразным.
Источник: Максим Спиридонов
Что мы знаем о компании
Anthropic
- инвестор
- Яан Таллинн
- черновик S-1 filing Anthropic 2026-09-30
- Трамп и ведущие IT-компании США (Google, Anthropic, Meta, OpenAI, xAI, Nvidia) подписали соглашение о совместных обязате 2026-09-30
- Anthropic впервые оценила открытую китайскую модель GLM-5.3 и опубликовала исследование о её кибервозможностях. 2026-09-30
- Модель Anthropic Claude Mythos Preview показала в ExploitBench результат 14%. 2026-09-30
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.