元の記事 · 公開: 2026-09-18

要約

Anthropic はアクセンチュア(の AI 専門部門 Faculty が主導)と、フロンティア AI の独立評価で提携。CEO のエッセイ「We Must Pace the Frontier」で表明した「評価者を社内に組み込む(embed)」というコミットメントの一歩で、両社は今後5年間でこの領域にそれぞれ最低10億ドルを投資する見込み。

主な変更・取り組み

提携の内容

Faculty がモデルの評価・レッドチーム演習、アライメント評価、安全策のテストを担当する。アクセンチュアは多くの業界で企業・政府の AI 導入を支援しており、実務での AI 利用に関する知見を評価に活かす。

  • 埋め込み型評価者とは: 外部評価者と異なり、社員に近いアクセス権を持ち、学習中のモデルの様子や開発・運用に関する意思決定を追跡でき、社員と直接対話できる。これにより会社の運営状況の評価・安全上のコミットメント遵守の検証・盲点の指摘が可能になり、インシデントの報告や、便益とリスクについてより情報に基づいた説明を公にできるようになる
  • 独立した埋め込み評価者がいても Anthropic の説明責任は減らず、むしろ検証可能になるという位置づけで、モデルの安全性の責任は引き続き Anthropic 自身にある
  • 資金は Anthropic がアクセンチュアの作業分を直接負担する。METR など他の非営利評価者とも、各評価者側の資金による試験運用を協議中。長期的にはプールされた資金や政府資金での運営が望ましいとしている(6月発表の Advanced AI Framework で言及済み)
  • 提携は非独占的で、Anthropic は今後数週間のうちに他の評価者との提携も発表予定。アクセンチュアも他の AI 開発企業と同様の協業を行う

背景

埋め込み型評価者がどの情報にアクセスすべきか、発見事項をどう報告すべきかの標準は、現時点ではまだ存在せず、独立評価のための恒久的な資金制度も未整備。そのため Anthropic は当面、評価者ごとに異なる資金の枠組みで協力していく方針。

破壊的変更・移行手順

なし

関連