Anthropic выпустил инструмент для тестирования плагинов Claude Code
Anthropic опубликовала новый workflow для оценки плагинов Claude Code — команда claude plugin eval запускает плагин на реалистичных промптах, оценивает результаты и сравнивает с работой базовой модели. Инструмент отвечает на три вопроса, которые разработчики не могли измерить раньше: срабатывает ли навык, сохраняется ли он при редактировании или обновлении модели, и превосходит ли плагин базовую версию.
Workflow работает на Claude Code v2.1.269 и позже, поддерживает любые директории с манифестом plugin.json. Каждый запуск и проверка выставляют счёт в аккаунт разработчика.
Источник: источник
Что мы знаем о компании
Anthropic
- Необходимо замедлить темпы развития искусственного интеллекта для решения проблем с контроля над ним , заявил глава Anthropic (разрабатывает большую языковую… 2026-09-12
- По прогнозам Anthropic, ИИ может увеличить ВВП США на 32% к 2030 году 2026-09-12
- Anthropic смоделировал три сценария 2030 2026-09-12
- LOCUS: Task-Aware Low-Rank Post-Training for Token-Efficient Language Generation 2026-09-12
Новости этого рынка выходят у нас в телеграме первыми — @adposium_ai.