i
ДАТАИСТ
Новости · 2026-09-18

Anthropic и Accenture объединяются для независимой оценки ИИ-моделей

@neuronium_ai @neuronium_ai

Anthropic начинает сотрудничество с Accenture для независимой оценки передовых ИИ-моделей. Партнёрство возглавит Faculty, специализированное ИИ-подразделение Accenture: специалисты будут проверять модели, проводить стресс-тесты, оценивать их согласованность и тестировать защитные механизмы. Обе компании рассчитывают вложить в развитие этого направления не менее $1 млрд каждая в течение следующих пяти лет. Оценщики будут работать внутри ИИ-компаний и получат доступ, сопоставимый с доступом сотрудников.

Обложка: Anthropic и Accenture объединяются для независимой оценки ИИ-моделей

Anthropic называет сотрудничество с Accenture шагом к выполнению обязательства, о котором говорилось в эссе генерального директора «We Must Pace the Frontier»: независимые оценщики должны работать непосредственно внутри Anthropic.

Партнёрство возглавит Faculty — специализированное ИИ-подразделение Accenture. В его рамках будут:

оценка моделей и стресс-тестирование;
проверки согласованности моделей;
тестирование защитных механизмов.

Accenture помогает компаниям и государственным организациям внедрять ИИ в разных отраслях. Понимание того, как предприятия используют ИИ на практике, должно повлиять на подход компании к безопасности и оценке моделей Anthropic.

Инвестиции: Anthropic и Accenture рассчитывают вложить не менее $1 млрд каждая в течение пяти лет.

Как будет работать оценка

Встроенная оценка — новое направление, и многие детали его работы ещё разрабатываются. В отличие от внешних оценщиков, встроенные специалисты будут работать внутри ИИ-компаний и получат доступ, сопоставимый с доступом сотрудников.

Это позволит им:

наблюдать за тем, как модели формируются во время обучения;
отслеживать решения, определяющие устройство и применение моделей;
напрямую общаться с сотрудниками;
оценивать внутренние процессы компании;
проверять выполнение обязательств по безопасности;
находить незамеченные проблемы;
сообщать об инцидентах;
давать обществу более подробное представление о преимуществах и рисках моделей.

Независимые встроенные оценщики не снимают с Anthropic ответственность, а делают её более проверяемой. За безопасность моделей по-прежнему отвечает Anthropic.

Правила и финансирование

Пока нет стандартов, которые определяли бы, к какой информации должны получать доступ встроенные оценщики и как им следует сообщать о результатах. Не сформировалась и устойчивая система финансирования независимой оценки.

В долгосрочной перспективе Anthropic считает, что финансирование должно поступать из объединённых или государственных источников. Компания уже призывала к этому в своей Advanced AI Framework, опубликованной в июне.

Поскольку сегодня таких механизмов нет, Anthropic планирует работать с разными оценщиками на разных условиях финансирования.

Из-за важности и срочности этой работы Anthropic напрямую профинансирует проект Accenture. Компания также ведёт переговоры с METR и другими некоммерческими оценщиками, чтобы опробовать отдельные элементы встроенной оценки за их счёт.

В перспективе Anthropic рассчитывает на экосистему оценщиков передовых ИИ-моделей, работающих по общим стандартам.

Партнёрство не эксклюзивно

Anthropic ожидает, что лаборатории, разрабатывающие передовые модели, будут одновременно сотрудничать с несколькими организациями. Соглашение с Accenture не является эксклюзивным: в ближайшие недели Anthropic объявит о новых партнёрах среди оценщиков, а Accenture будет работать с другими разработчиками ИИ в аналогичном формате.

Anthropic продолжит обучать и выпускать передовые модели и хочет, чтобы независимые оценщики работали рядом с компанией в этом процессе. Компания решила рассказать о первых шагах сейчас, чтобы люди и другие разработчики ИИ могли видеть, как устроен этот процесс.

По мере развития направления подход Anthropic будет меняться. Компания обещает рассказывать о дальнейшей работе и новых оценщиках по мере их подключения.

Лишь 6% компаний получают отдачу от ИИ. Вот что они делают иначе Агенты OpenAI обменивались сообщениями ещё до инцидента с Hugging Face Безопасность ИИ нужна бизнесу, чтобы его внедряли клиенты Глава Alation предупреждает: даже умные ИИ-агенты могут неправильно понять ваш бизнес Дарио Амодеи сослался на рекурсивное самоулучшение в сентябрьском эссе Предприниматели заново оценивают человеческий капитал в эпоху ИИ Америка лидирует в ИИ. Китай строит роботов Кто на самом деле управляет вашим ИИ и данными? Почему это важно каждому бизнесу «Обучение с подкреплением для калиброванных решений» в заголовках об ИИ — но без шумихи Рой из 700 агентов: чему OpenAI и Hugging Face научили руководителей бизнеса Что управляет ИИ-агентами? Амодеи хочет притормозить передовые разработки ИИ — но этого мало Как основателям пользоваться ИИ, не становясь от него зависимыми Новый тип ИИ-модели от одного из создателей ChatGPT приводит разработчиков в восторг Почему Европа осталась в стороне от главного спора о безопасности ИИ Внутренние системы OpenAI взломали с помощью Claude от Anthropic менее чем за 72 часа Первый технический директор Disney возглавлял стартап, который компания обвиняла в копировании персонажей Губернатор Калифорнии Гэвин Ньюсом подписал указ: ИИ-моделям — «выключатель» Жена Марка Цукерберга установила жёсткие ограничения на использование ИИ их 11-летней дочерью Может ли ИИ представлять серьёзную угрозу для нашего существования?

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram