Anthropic и Accenture: оценщики внутри лаборатории вместо внешнего аудита

Anthropic и Accenture запускают схему встроенной оценки фронтирных моделей: независимые аудиторы сидят внутри лаборатории с доступом, сопоставимым с сотрудником. Они видят, как модель учится, какие решения принимают перед релизом, и могут вынести инцидент наружу. Контур ведёт Faculty — специализированное AI-подразделение Accenture.
Дата анонса — 18 сентября 2026 года. Замысел связан с обещанием из эссе CEO Anthropic «We Must Pace the Frontier»: встроить оценщиков в процесс, а не ограничиваться внешними отчётами раз в квартал.
Что входит в оценку
- оценка моделей и красная команда (red team);
- проверка соответствия заявленным целям;
- тестирование ограничителей и safeguards.
Anthropic и Accenture каждая планирует вложить не меньше $1 billion в эту линию за пять лет. Партнёрство неэксклюзивное: лаборатория обещает других оценщиков в ближайшие недели, Accenture — похожие контракты с другими разработчиками моделей.
Стандартов доступа и отчётности для встроенных оценщиков пока нет, как и устоявшейся схемы их финансирования. Пока что работу Faculty Anthropic оплачивает напрямую; параллельно идёт диалог с METR и другими nonprofit-оценщиками на их собственном финансировании. В долгую компания зовёт к пуловому или государственному финансированию — как в Advanced AI Framework от июня.
Ответственность за безопасность моделей остаётся на разработчике: встроенные оценщики, по формулировке Anthropic, делают обязательства проверяемыми, а не снимают её.
Источник: Partnering with Accenture on embedded evaluation.