Anthropic выпустил инструмент для тестирования плагинов Claude Code
Anthropic опубликовала новый workflow для оценки плагинов Claude Code — команда claude plugin eval запускает плагин на реалистичных промптах, оценивает результаты и сравнивает с работой базовой модели. Инструмент отвечает на три вопроса, которые разработчики не могли измерить раньше: срабатывает ли навык, сохраняется ли он при редактировании или обновлении модели, и превосходит ли плагин базовую версию.
Workflow работает на Claude Code v2.1.269 и позже, поддерживает любые директории с манифестом plugin.json. Каждый запуск и проверка выставляют счёт в аккаунт разработчика.
Источник: MarkTechPost
Что мы знаем о компании
Anthropic
- инвестор
- Яан Таллинн
- черновик S-1 filing Anthropic 2026-09-30
- Трамп и ведущие IT-компании США (Google, Anthropic, Meta, OpenAI, xAI, Nvidia) подписали соглашение о совместных обязате 2026-09-30
- Anthropic впервые оценила открытую китайскую модель GLM-5.3 и опубликовала исследование о её кибервозможностях. 2026-09-30
- Модель Anthropic Claude Mythos Preview показала в ExploitBench результат 14%. 2026-09-30
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.