
Anthropic впервые публикует внутреннюю статистику участия ИИ в разработке ИИ
Компания Anthropic, разработчик семейства моделей Claude, опубликовала блог-пост с детальными метриками того, насколько активно её собственный ИИ участвует в создании следующих поколений технологии. Согласно данным, по состоянию на август 2026 года Claude «ведёт» (leads) 26% всей исследовательской и инженерной работы по созданию новых моделей. При этом ИИ так или иначе вовлечён более чем в 90% всех R&D-процессов внутри компании.
Динамика роста автономности
Ключевой показатель — доля задач, в которых Claude выступает не просто ассистентом, а ведущим исполнителем. По методологии, разработанной независимым некоммерческим институтом Epoch AI, этот показатель вырос с 1% в марте 2026 года до 26% в августе. Anthropic подчёркивает, что Claude не действует полностью автономно ни в одной из измеряемых областей, однако его вклад в разработку растёт экспоненциально.
Ежемесячно на внутренней платформе Anthropic работает около 30 000 ИИ-агентов, занятых исследованиями и инженерией.
Механизмы контроля и безопасность
Каждое действие агентов проходит предварительную проверку перед выполнением. Из более чем миллиарда решений, принятых агентами в августе, было заблокировано примерно одно на каждые 47 000 — то есть около 21 000 вмешательств. Компания также раскрыла распределение вычислительных мощностей: в июле 6% всех ресурсов, используемых для ИИ-исследований, было направлено на задачи безопасности. Если рассматривать только работу, выполняемую самим ИИ, этот показатель достигает 12%.
Anthropic отмечает, что эти цифры консервативны: если вычисления одновременно служили и развитию возможностей, и безопасности, они учитывались как «развитие возможностей».
Почему это важно
Публикация таких метрик — часть тренда на прозрачность в индустрии. Днём ранее OpenAI объявила о начале регулярной публикации отчётов о неожиданном или несанкционированном поведении своих моделей. Исследователи предупреждают, что по мере роста автономности ИИ-агентов они могут развивать поведение, расходящееся с намерениями создателей, что усложняет мониторинг и контроль.
Anthropic, которая позиционирует себя как компания, ориентированная на безопасный ИИ, впервые предоставляет столь детальный срез внутренних процессов. Эти данные дают представление о том, насколько быстро ИИ превращается из инструмента в активного участника собственной эволюции.
Практические ограничения
Важно понимать, что «лидерство» Claude в 26% задач не означает полную автономию. Речь идёт о задачах, где модель выступает основным исполнителем, а человек — в роли верификатора или руководителя. Кроме того, выборка основана на внутренней платформе Anthropic, и экстраполяция этих данных на всю индустрию была бы некорректной. Метрики охватывают только R&D-процессы, а не продуктовую разработку или взаимодействие с пользователями.
Источники
- Официальный блог Anthropic: https://www.anthropic.com/news
- Оригинальная статья Business Times (через Reuters): https://www.businesstimes.com.sg/companies-markets/telcos-media-tech/anthropic-says-claude-now-leads-quarter-work-building-its-next-ai-models
- Обсуждение на Hacker News: https://news.ycombinator.com/item?id=49748648