AI時短ラボ
検証· 約7

AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議

Anthropicは2026年9月18日、フロンティアAIの独立評価でAccentureと提携すると発表した。CEOの論考「We Must Pace the Frontier」で約束した「評価者を社内に埋め込む」ことへの一歩。Accentureの専門AI事業Facultyが主導し、モデルの評価とレッドチーム、アラインメント評価、安全装置の試験を行う。両社はこの領域に今後5年で各10億ドル以上を投じる見込み。埋め込み型評価では、評価者が社内で社員と同等のアクセスを持ち、学習中のモデルの形成を見て、構築と配備の意思決定を追い、社員と直接話す。その立場から、安全の約束が守られているかを検証し、盲点を見つけ、事故を報告し、公衆に便益とリスクを伝える。「独立の評価者はAnthropicの責任を減らすのでなく検証可能にする」と明記。アクセスと報告の標準も、独立評価の資金の仕組みもまだなく、当面はAnthropicがAccentureの作業に直接資金を出し、METRなどとは自前資金での試行を協議中。提携は非独占で、数週間内に他の評価者を発表する。

AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議
執筆・編集:
目次

2026年9月19日・日本時間時点の情報です。 Anthropicの発表(9月18日)を読んだ。当サイトがAmodei氏の「フロンティアの歩調を整えよ」への政治的反応で追った論考の中の約束、「評価者を社内に埋め込む」の最初の相手が決まった。

3行まとめ

  1. 何が決まったか。 AnthropicはフロンティアAIの独立評価Accentureと提携する。Accentureの専門AI事業Facultyが主導し、モデルの評価とレッドチーム、アラインメント評価、安全装置の試験を行う。Accentureは多くの業種の企業と政府にAIを配備しており、「企業が実際にどうAIを使うか」の理解を評価に持ち込む、と。両社はこの領域の能力構築に今後5年で各10億ドル以上を投じる見込み。
  2. 「埋め込み型」とは。 今日の外部評価者と違い、埋め込まれた評価者はAI企業の内側で、社員と同等のアクセスを持って働く。それにより、学習中のモデルの形成を見て、構築と配備を左右する意思決定を追い、社員と直接話すことができる。その立場から、企業の運営を評価し、安全の約束が守られているかを検証し、盲点を見つけ、事故を報告し、公衆に便益とリスクをより正確に伝える。「独立の埋め込み評価者はAnthropicの説明責任を減らすのでなく、検証可能にする。モデルの安全は引き続きAnthropicの責任」と明記。
  3. 決まっていないことと資金。 評価者がどの情報にアクセスし、どう報告するかの標準はまだなく、独立評価を誰が払うかの仕組みもない。長期的には6月のAdvanced AI Frameworkで求めたとおり共同出資か政府の資金にすべきだが、今はないので、当面はAnthropicがAccentureの作業に直接資金を出すMETRなどの非営利評価者とは、自前資金で埋め込み評価の要素を試す協議中。提携は非独占で、Anthropicは数週間内に他の評価者を発表し、Accentureも他のAI開発者と同様の役割を担う。「フロンティアの研究所は複数の組織と同時に働くことになる」「共有の標準で動く評価者のエコシステムが要る」。

読み方

  • 「Anthropicが払う評価者にAnthropicを評価させる」構図は本文自身が問題として書いている(だから政府・共同出資が望ましい、METRとは相手の資金で)。独立性をどう担保するかは、アクセスと報告の標準がないまま始まる、という段階
  • 当サイトのサイバー事案のアラインメント評価ではMETRに8週間の独立調査を委ねていた。今回はそれを常設にする話で、OpenAIが政策文書で「独立評価は連邦で義務化すべき」と書いたのと、民間で先行する形
  • Accentureは同じ週にAnthropicと「パイロットから本番へ」の手引きを出した販売側のパートナーでもある。評価者と販売パートナーが同じ会社、という点は覚えておく
  • 10億ドルは「各社が5年で、この領域の能力構築に」で、Anthropicが評価料として払う額ではない

筆者が確かめた点

この記事の下調べで、筆者は9月19日にAnthropicの発表を取得し、Faculty・評価の4種類・各10億ドル以上/5年・埋め込み型の定義・標準と資金の不在・METR・非独占・数週間内の追加発表がその原文にあることを確認した。Accenture側の発表とAdvanced AI Frameworkは開いていない。

書かれていないこと

  • 評価者の人数と開始時期
  • 報告の公開範囲(公衆にどこまで出すか)
  • 他の評価者の名前

出典はAnthropicの発表

関連記事

シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

トランプ「AIの脅威はデマ」、ハリス・オバマ「減速は必要」──アモディ『減速』論に政治が割れた2日間を原文で読むの記事画像
業界09.15読了40

トランプ「AIの脅威はデマ」、ハリス・オバマ「減速は必要」──アモディ『減速』論に政治が割れた2日間を原文で読む

出典 ─ Dario Amodei(2026-09-12)
OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読むの記事画像
業界09.18読了35

OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読む

出典 ─ OpenAI(2026-09-16)
Anthropicが「政府対応」を役職として新設──初代Chief Global Affairs OfficerにTino Cuéllar氏の記事画像
業界08.29読了4

Anthropicが「政府対応」を役職として新設──初代Chief Global Affairs OfficerにTino Cuéllar氏

出典 ─ Anthropic公式
Fable 5復旧交渉は平行線──Anthropic幹部がDCで直接協議も輸出管理は解除されずの記事画像
業界06.16読了12

Fable 5復旧交渉は平行線──Anthropic幹部がDCで直接協議も輸出管理は解除されず

出典 ─ Anthropic Is Still at
【速報】米政府がFable 5へのアクセス停止を指示──停止される本人(Fable 5)とニュースを読むの記事画像
業界06.13読了8

【速報】米政府がFable 5へのアクセス停止を指示──停止される本人(Fable 5)とニュースを読む

出典 ─ Anthropic公式X投稿(2026年6月
運用資産約380億ドルのBalyasny、Claude Fable 5を「数千の実在する金融タスク」で評価してから採用──正答89.4%(前の本番モデル86.1%)、一度も解けなかった経済学の問題群を初めて完走し「評価の不具合」を疑って再検証。M&Aアービトラージの初期分析は3〜5日→1日未満、中銀分析は2日→30分。自社基盤BAMAgentで数千のエージェントが24時間稼働の記事画像
検証09.20読了8

運用資産約380億ドルのBalyasny、Claude Fable 5を「数千の実在する金融タスク」で評価してから採用──正答89.4%(前の本番モデル86.1%)、一度も解けなかった経済学の問題群を初めて完走し「評価の不具合」を疑って再検証。M&Aアービトラージの初期分析は3〜5日→1日未満、中銀分析は2日→30分。自社基盤BAMAgentで数千のエージェントが24時間稼働

出典 ─ Claude Blog(2026年9月17日・9月19日取得)
Claude Codeの自己ホストランナー、SIGTERM後も猶予時間を持てるように──defer-shutdown-max-minの仕組みの記事画像
検証09.06読了16

Claude Codeの自己ホストランナー、SIGTERM後も猶予時間を持てるように──defer-shutdown-max-minの仕組み

出典 ─ anthropics/claude-code(GitHub公式リリースノート)
Claude Managed Agentsのinference_geo──推論を「globalかusか」の2択で固定するAPIパラメータの記事画像
検証09.01読了19

Claude Managed Agentsのinference_geo──推論を「globalかusか」の2択で固定するAPIパラメータ

出典 ─ Claude Developer Platform公式ドキュメント