Новая система прозрачности для передовых лабораторий ИИ
Компания Anthropic выпустила комплексный набор внутренних метрик, призванных обеспечить внешнюю прозрачность темпов разработки ИИ. Отчет Anthropic, опубликованный в сентябре 2026 года, фокусируется на трех ключевых аспектах: степени автоматизации разработки ИИ самими моделями, эффективности надзора за автономными агентами и распределении вычислительных ресурсов между безопасностью и расширением функциональности.
По мере роста мощности передовых моделей ИИ, отрасль сталкивается с растущим давлением, требующим доказательств того, что процесс разработки остается под контролем человека. Инициатива Anthropic направлена на создание воспроизводимой системы, которую могли бы внедрить другие лаборатории, что потенциально может послужить основой для будущего государственного регулирования.
Измерение R&D, проводимого ИИ
Одним из наиболее значимых показателей является «Индекс автоматизации R&D Anthropic». Используя шкалу автоматизации (AL), разработанную Epoch AI, компания оценила роль моделей Claude во внутренних исследованиях. По состоянию на август 2026 года данные показывают, что, хотя Claude не работает полностью автономно, он в настоящее время «возглавляет» 26% исследовательских работ Anthropic, выполняя задачи от начала до конца под наблюдением человека. Более того, более 90% внутренних R&D-задач включают сотрудничество с ИИ.
Надзор за агентами и использование ресурсов
В отчете также подробно описывается режим надзора за примерно 30 000 агентов, работающих на внутренних платформах Anthropic. Мониторинг разделен на онлайн-надзор, блокирующий опасные действия в реальном времени, и офлайн-надзор, анализирующий активность постфактум. По данным за август 2026 года, 100% действий агентов проходят через эти системы мониторинга. За период исследования было заблокировано лишь 0,002% из более чем миллиарда решений, что свидетельствует о том, что случаи нежелательного поведения агентов остаются редкими, но требуют строгих протоколов контроля.

