Инициатива связана с идеей «встроенных оценщиков», о которой CEO Anthropic Дарио Амодеи говорил в июне. По версии компании, такие команды должны работать внутри ИИ-разработчиков с доступом, сопоставимым с правами сотрудников. Это позволит наблюдать за обучением моделей, развертыванием и внутренними решениями, общаться с персоналом, проверять выполнение обязательств по безопасности и искать уязвимости в процессах.
В сентябре Амодеи призвал замедлить развитие передовых ИИ-моделей, сославшись на растущие риски безопасности. Одним из аргументов вступил инцидент с OpenAI и Hugging Face. Глава Anthropic предложил три направления для снижения рисков: международные договоренности, общие правила для индустрии и независимые проверки внутри лабораторий.
Партнерство с Accenture не эксклюзивное: Anthropic планирует объявить о сотрудничестве с другими оценщиками в ближайшие недели, а консалтинговая фирма будет работать со сторонними ИИ-разработчиками в аналогичном формате. Параллельно ведутся переговоры с некоммерческой организацией METR о пилоте встроенной оценки на ее собственном финансировании.
Долгосрочно Anthropic видит финансирование независимых проверок из пулированных или государственных источников — как предусмотрено инициативой Advanced AI Framework. Пока таких механизмов нет, компания оплачивает работу Accenture напрямую, признавая, что это создает очевидное противоречие с точки зрения независимости оценщика.
Напомним, CEO Nvidia Дженсен Хуанг выступил против регуляторного замедления ИИ, назвав безопасность технологии «инженерной проблемой».