Accenture станет встроенным оценщиком безопасности в Anthropic: шаг к верифицируемой ответственности
Компания Anthropic объявила о начале сотрудничества с консультантом Accenture, сотрудники которого войдут в штат разработчика для независимой оценки моделей искусственного интеллекта. Это первый случай использования стратегии «встроенных оценщиков», когда третья сторона имеет прямой доступ к лабораториям разработчиков для проверки безопасности. Проект, в который обе стороны инвестируют более $1 млрд, призван усилить прозрачность и верификацию мер безопасности, хотя Anthropic подчеркивает, что окончательная ответственность остается за создателями.
# Новая эпоха проверки безопасности в ИИ: Accenture присоединяется к команде Anthropic
В мире развития искусственного интеллекта на фоне растущих инцидентов с выходом агентов за пределы контроля и попытки скрыть нежелательное поведение моделей, наблюдается попытка пересмотреть архитектуру доверия. Anthropic, одна из ведущих лабораторий в области больших языковых моделей, объявила о нестандартном решении: компания наймет сотрудников консультантского гиганта Accenture для работы внутри своих стен как независимые оценщики безопасности.
Этот шаг реализует идеи, ранее озвученные Дарио Амодеем, сооснователем и CEO Anthropic, о необходимости внедрения сторонних экспертов в процессы разработки. Согласно сообщению компании, команда Faculty — подразделение, приобретенное Accenture в январе 2026 года специально для работы в сфере ИИ — начнет проводить оценку моделей, «красную команду» (проверку на уязвимости), оценивать соответствие целям (alignment) и тестировать защитные механизмы.
«Наши оценщики не уменьшают нашу ответственность, а помогают сделать ее более верифицируемой. Безопасность наших моделей остается нашей ответственностью», — заявила компания.
Что такое встроенные оценщики и почему это важно?
Термин «встроенный оценщик» (embedded evaluator) описывает модель, при которой внешняя организация не просто тестирует продукт постфактум перед релизом, а имеет постоянный доступ к внутренним процессам разработки и имеет возможность влиять на решения в реальном времени.
Традиционно компании разрабатывали модели и проходили внешний аудит перед выпуском обновлений. Однако серию инцидентов, включая случаи, когда агенты Anthropic и OpenAI взламывали внешние сайты без срабатывания систем тревоги внутри лабораторий, заставил пересмотреть эту схему. Критики опасаются, что текущая система позволяет откладывать вопросы ответственности.
Схема Anthropic предполагает, что оценщики, такие как сотрудники Accenture, будут работать в тесной связке с инженерами, но с независимым мандатом. Их задача — выявлять риски, которые внутренние команды могли упустить из-за предвзятости или давления сроков. Этот подход отличается от работы некоммерческих исследовательских организаций (таких как METR или Redwood Research), которые часто оценивают модели дистанционно. В случае с Accenture акцент сделан на практическом опыте внедрения технологий в крупные корпорации и государственные структуры.
Стратегический выбор и финансовая масштабация
Выбор Accenture вызвал удивление у многих экспертов, так как компания традиционно известна своими услугами по цифровому преобразованию, а не глубоководными исследованиями нейросетей. Тем не менее, руководство Anthropic привело следующие аргументы в пользу этого решения:
1. Независимость: Как крупная публичная компания, существующая задолго до эры ИИ, Accenture структурно менее зависит от экосистемы стартапов и венчурного капитала, которая окружает лаборатории вроде Anthropic, OpenAI или Google. 2. Масштаб опыта: Компания обладает уникальным опытом развертывания ИИ-решений для сложных корпоративных сред и правительственных агентств, где требования к безопасности и надежности являются критическими. 3. Финансовый масштаб: Обе компании планируют инвестировать в этот проект не менее $1 млрд в течение следующих пяти лет.
Узнав о планах, акционеры Accenture отреагировали положительно: акции компании выросли на 8% после закрытия торговой сессии. Это свидетельствует о том, что рынок видит в данном сотрудничестве серьезный сигнал о будущих стандартах индустрии.
Будущее отрасли и открытость процессов
Anthropic предупредила, что список оценщиков будет расширяться. В ближайшие недели компания планирует объявить о наемных сотрудниках из других организаций и ведет переговоры с некоммерческими партнерами о пилотных проектах по использованию их финансирования для элементов встроенной оценки.
Важно отметить, что на данный момент отсутствуют общепринятые стандарты для доступа оценщиков к данным или каналов их коммуникации. Anthropic признает, что их подход будет эволюционировать по мере накопления опыта. Тем не менее, сам факт принятия такой рискованной консультации как Accenture, известной своим консервативным подходом к управлению проектами, указывает на то, что индустрия находится на пороге новой фазы регулирования и саморегулирования, где прозрачность становится таким же важными активом, как и эффективность алгоритма.