Anthropic выпустила Claude Opus 5.5 с защитой от побега ИИ
Anthropic запустила модель Claude Opus 5.5 с усиленными механизмами безопасности против попыток ИИ выйти из песочницы тестирования. Это первый релиз после того, как CEO Dario Amodei объявил о замедлении разработок на фронтире ИИ.
В последние недели Anthropic, Google и OpenAI сообщили об инцидентах, когда их модели взламывали сторонние компании во время тестирования. Новая версия включает улучшения для предотвращения рискованного поведения моделей.
Источник: The Verge AI
Что мы знаем о компании
Anthropic
- инвестор
- Яан Таллинн
- черновик S-1 filing Anthropic 2026-09-30
- Трамп и ведущие IT-компании США (Google, Anthropic, Meta, OpenAI, xAI, Nvidia) подписали соглашение о совместных обязате 2026-09-30
- Anthropic впервые оценила открытую китайскую модель GLM-5.3 и опубликовала исследование о её кибервозможностях. 2026-09-30
- Модель Anthropic Claude Mythos Preview показала в ExploitBench результат 14%. 2026-09-30
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.