Anthropic встроит независимых оценщиков внутрь себя: партнёрство с Accenture на $1 млрд
Anthropic делает шаг к обещанию из эссе своего CEO «We Must Pace the Frontier» — встраивает независимых оценщиков прямо внутрь себя. Партнёром стала Accenture, а точнее её специализированное ИИ-подразделение Faculty. Они будут оценивать модели, проводить red-teaming, проверять согласованность (alignment) и тестировать защитные механизмы.
Ключевое отличие от внешних оценщиков — доступ: встроенные специалисты будут работать внутри компании с правами уровня сотрудника. Это позволит им наблюдать за тренировкой моделей, видеть решения по их разработке и развёртыванию, общаться с командой. Идея в том, чтобы делать безопасность не просто декларируемой, а проверяемой изнутри.
Финансирование — отдельный вопрос: стандартов и системы финансирования такой оценки пока нет. В долгосрочной перспективе Anthropic выступает за пул средств или госфинансирование, но сейчас компания будет напрямую платить Accenture. Также ведутся переговоры с METR и другими некоммерческими оценщиками о пилотных проектах на их собственном финансировании.
Партнёрство неэксклюзивное: Anthropic планирует работать с несколькими оценщиками, а Accenture — с другими разработчиками ИИ. Ожидается, что в ближайшие недели появятся новые анонсы. Пока же компания делится ранними наработками, чтобы показать процесс и дать другим игрокам ориентир.