Экономика создателей

Anthropic впустит аудиторов внутрь — две компании вложат по $1 млрд

|Автор: Редакция QUASA|4 мин чтения
Anthropic впустит аудиторов внутрь — две компании вложат по $1 млрд

В опубликованном 18 сентября 2026 года совместном объявлении Anthropic и Accenture говорится о создании команды встроенных оценщиков, которая будет работать рядом с внутренними подразделениями Anthropic и её партнёрами по безопасности. Каждая компания рассчитывает вложить в развитие этого направления не менее $1 млрд в течение пяти лет.

Работу возглавит Faculty, специализированное подразделение Accenture в области ИИ. Его специалисты будут оценивать модели, проводить состязательное тестирование, проверять согласование поведения моделей с заданными целями и испытывать защитные механизмы. Это планируемая система постоянной проверки, а не завершённый аудит: состав команды, дата начала работы и подробные гарантии её независимости пока не раскрыты.

Какие задачи получит Faculty

Состязательное тестирование предполагает целенаправленный поиск нежелательного поведения и способов обойти ограничения модели. Оценка согласования должна показать, сохраняет ли система заданное поведение в сложных условиях, а испытание защитных механизмов — выдерживают ли ограничения намеренные попытки их преодолеть.

Публичные материалы не называют численность и персональный состав команды, модели первой очереди или расписание испытаний. В них также нет результатов проверок. Поэтому речь идёт о создании механизма оценки и увеличении соответствующих ресурсов, а не о сертификации уже выпущенной системы.

Чем встроенная оценка отличается от внешнего аудита

Обычная внешняя оценка чаще сосредоточена на ограниченном срезе системы: определённой версии модели, согласованных интерфейсах и заранее установленном наборе тестов. Организационная дистанция между разработчиком и проверяющим при этом больше, однако оценщик не обязательно видит, как модель меняется во время обучения и почему принимаются конкретные решения о её выпуске.

Встроенная схема переносит проверку внутрь жизненного цикла модели. Согласно описанию программы Anthropic, оценщики получат доступ, сопоставимый с доступом сотрудника: смогут наблюдать за формированием модели при обучении, прослеживать решения о её создании и развёртывании и напрямую обращаться к работникам компании. Предполагается, что с этой позиции они смогут проверять выполнение обязательств по безопасности, выявлять слепые зоны и сообщать об инцидентах.

Доступ уровня сотрудника не означает автоматически неограниченный доступ ко всем данным, системам и внутренним обсуждениям. Общих стандартов, определяющих доступную встроенным оценщикам информацию и порядок сообщения о результатах, пока нет. Точные границы полномочий будут зависеть от ещё не опубликованных рабочих правил.

Стороны называют участников программы встроенными оценщиками, а не аудиторами в формальном значении. Слово «аудиторы» в заголовке описывает их функцию сторонней проверки: компании не заявляли о применении признанного стандарта аудита, обязательной процедуре заверения заключения или выдаче сертификата.

Как проверка охватит путь от обучения до развёртывания

Из опубликованных условий складывается четырёхэтапная схема, хотя конкретные права команды на каждом этапе ещё не определены:

  1. Обучение. Оценщики смогут наблюдать, как модель приобретает возможности, до фиксации окончательной версии.
  2. Решения о развёртывании. Команда сможет прослеживать выбор защитных мер и условий выпуска, а также обсуждать эти решения с сотрудниками Anthropic.
  3. Состязательные испытания. Faculty будет искать нежелательное поведение и способы обхода ограничений.
  4. Работа после развёртывания. В предполагаемые полномочия входят проверка обязательств по безопасности и сообщение об инцидентах.

Главное отличие от разовой внешней проверки — непрерывность наблюдения: оценщик подключается не только к готовому продукту, но и к решениям, формирующим его поведение. Однако неизвестно, сможет ли команда требовать дополнительные данные, самостоятельно расширять тестирование, добиваться переноса выпуска или лишь рекомендовать изменения.

Глубина доступа не гарантирует независимость

В конструкции партнёрства сохраняется напряжение. Чем раньше оценщик подключается к разработке, тем больше рисков он потенциально может обнаружить. Но тесная включённость в процессы проверяемой компании повышает значение правил, защищающих право на несогласие и неблагоприятный вывод.

Anthropic будет напрямую оплачивать работу Accenture; при этом соглашение заявлено как неисключительное. Независимое подтверждение условий и масштаба вложений содержит материал The Washington Post: издание также указывает, что каждая сторона намерена направить на безопасность ИИ не менее $1 млрд за пять лет. Возможность привлекать других оценщиков снижает зависимость от единственного исполнителя, но сама по себе не устраняет конфликт между глубиной доступа и самостоятельностью проверки.

Пока не раскрыты ключевые организационные гарантии:

  • кому будет подотчётна команда Faculty и кто оценит качество её работы;
  • сможет ли она самостоятельно выбирать тесты и увеличивать их объём;
  • получит ли она право публиковать выводы без согласования с Anthropic;
  • будут ли документироваться отказы в доступе к данным, системам или сотрудникам;
  • как стороны разрешат спор о серьёзности обнаруженного риска;
  • какие сведения могут быть закрыты как коммерческая тайна.

Отсутствие этих деталей не доказывает зависимость будущей команды. Оно означает, что по одной лишь глубине доступа нельзя оценить её реальную независимость. Для этого нужны правила, позволяющие проверяющему выбирать предмет исследования, фиксировать препятствия и сообщать о выводах, невыгодных заказчику.

Что известно на текущем этапе

Подтверждены само партнёрство, руководящая роль Faculty, основные направления оценки и планы обеих компаний по финансированию направления. Обозначенные вложения отражают ожидания сторон, а не уже перечисленные средства и не безусловную гарантию расходов в полном объёме.

Следующей проверяемой стадией станет устройство программы: фактический состав команды, границы доступа, подотчётность, процедура сообщения об инцидентах и условия раскрытия результатов. Пока этих правил нет в открытом доступе, партнёрство обещает более глубокую проверку моделей изнутри, но ещё не позволяет судить, насколько независимым окажется проверяющий.

Читайте также:

Поделиться:

Подпишитесь на рассылку

Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.

0