Anthropic и Accenture договорились создать команду внешних специалистов, которая будет проверять передовые модели искусственного интеллекта прямо во время их разработки. В течение пяти лет каждая компания рассчитывает вложить в это направление не менее $1 млрд — вместе не менее $2 млрд.

Работу возглавит Faculty, специализированное ИИ-подразделение Accenture. Его специалисты будут проводить стресс-тесты моделей Anthropic, искать способы обхода защитных механизмов и оценивать, насколько поведение систем соответствует заявленным ограничениям.

Аудит хотят сделать постоянным

Сегодня независимая проверка ИИ часто напоминает испытание закрытого устройства. Исследователям дают готовую модель или доступ через API, после чего они пытаются обнаружить опасное поведение снаружи. Внутренние эксперименты, журналы инцидентов и решения, принятые во время разработки, при этом остаются за пределами проверки.

Anthropic предлагает другой подход. Встроенные оценщики — компания использует термин embedded evaluators — должны работать рядом с разработчиками ещё до публичного выпуска модели. По заявлению компании, их уровень доступа будет сопоставим с доступом сотрудников: они смогут наблюдать за обучением, изучать решения команд и сообщать об инцидентах.

Почему это важно: проверять будут не только готовую версию Claude, но и процесс, в котором модель обучают, тестируют и готовят к выпуску.

В теории это позволит раньше замечать проблемы, которые плохо видны в обычных тестах: неожиданные способы обхода ограничений, опасные возможности в кибербезопасности или расхождение между публичными обещаниями компании и её внутренней практикой.

Независимость пока не гарантирована

У схемы есть очевидное противоречие: работу независимого аудитора будет оплачивать сама проверяемая компания. Anthropic признаёт, что для встроенной оценки пока нет общепринятых стандартов. Не определено, какие данные обязан видеть аудитор, что он вправе публиковать и как защищать его от давления заказчика.

В долгосрочной перспективе Anthropic предлагает финансировать такие проверки из общих отраслевых или государственных фондов. Пока этого механизма нет, компания будет оплачивать работу Accenture напрямую и параллельно обсуждать пилотные проекты с некоммерческой исследовательской организацией METR.

Партнёрство неэксклюзивное: Anthropic сможет привлекать другие проверяющие организации, а Accenture — работать с другими разработчиками ИИ. Это важная деталь, потому что одна команда аудиторов не должна становиться единственным арбитром для всей отрасли.

Что изменят два миллиарда долларов

Заявленные средства предназначены не для обучения новой крупной модели и не для закупки ускорителей. Компании собираются развивать отдельную инфраструктуру проверки ИИ — со специалистами, методиками и постоянным присутствием внутри лабораторий.

Сам размер вложений, однако, не гарантирует независимого контроля. Anthropic пока не сообщила, какие результаты Accenture сможет публиковать без согласования, будут ли выходить полные отчёты и получат ли аудиторы доступ ко всем существенным инцидентам.

Вывод

Партнёрство Anthropic и Accenture — попытка превратить аудит ИИ из разового теста перед запуском в постоянный процесс. Если проверяющие получат реальную свободу и возможность открыто говорить о проблемах, схема может стать ориентиром для отрасли. Если результаты останутся закрытыми, это будет дорогая внутренняя проверка под вывеской независимого контроля.

Источники

  1. Anthropic — официальное сообщение о партнёрстве
  2. Accenture — условия программы и роль Faculty
  3. Reuters — независимое подтверждение и контекст