Anthropicが社内AI評価にAccenture傘下のFacultyを起用 — 「組み込み評価者」とは?

この記事は時点のニュースです。現在の提供状況とは異なる場合があります。誤りの訂正は随時行います。


組み込み評価者のしくみ Anthropic モデルの学習 公開の判断 社員への聞き取り (評価される側) 評価者(Faculty) Accenture傘下のAI企業 社員に近い水準の アクセスで社内に入る (評価する側) 社内で確認 資金はAnthropic 評価者が行う作業 レッドチーミング アラインメント評価 安全対策のテスト 資金の出どころ・アクセスや報告の標準は、発表自身が挙げる論点
組み込み評価者のイメージ(2026年9月18日の発表をもとに整理)
ひよこ ひよこ
AnthropicがAccentureと組むってニュースを見たよ。何をするの?
ペンギン先生 ペンギン先生
2026年9月18日に両社が発表したよ。Accentureが買収したAI企業のFacultyの人たちが「組み込み評価者」として、Anthropicの社内チームと並んで、モデルのレッドチーミング(あえて攻撃して弱点を探すテスト)、アラインメント評価(人の意図や価値観に沿って動くかの確認)、安全対策のテストを行う計画だよ。
ひよこ ひよこ
組み込み評価者って、ふつうの外部監査と何が違うの?
ペンギン先生 ペンギン先生
会社の中に入って見るところだね。Anthropicの説明では、社員に近い水準のアクセスで、モデルの学習の様子や公開の判断を見て、社員に直接話も聞く。そのうえで安全に関する約束が守られているかを確かめて、見落としを探す役割だよ。完成品だけを外から検査するのとは違うんだ。
ひよこ ひよこ
10億ドルって数字も見たよ。それをAccentureに払うの?
ペンギン先生 ペンギン先生
そこは読み違えやすいよ。発表は「AnthropicとAccentureがそれぞれ、5年間で少なくとも10億ドルを投資する見込み」という書き方で、あくまで見込みなんだ。しかも安全なAI開発に向けた投資の約束で、評価者への報酬が10億ドルという意味ではないよ。評価者チームの人数や開始日も、発表には書かれていないんだ。
ひよこ ひよこ
評価される会社がお金も出すの? それで公平になるの?
ペンギン先生 ペンギン先生
いいところに気づいたね。Anthropicは、Accentureの作業には自社が直接資金を出すと書いているよ。同時に、本来は会社単独ではなく、共同拠出や政府など別の出どころのほうが望ましいことも認めているんだ。評価者がどこまで見られるか、どう報告するかという標準も、まだないと書いている。お金を出す側と評価される側が同じという弱点は、発表自身が挙げている論点なんだね。
ひよこ ひよこ
評価者が入ったら、Anthropicの責任は軽くなるの?
ペンギン先生 ペンギン先生
Anthropicは「安全は引き続き自社の責任」で、独立した評価者は責任を減らすのではなく、より確認しやすくするものだと説明しているよ。ただ、これは会社側の説明なんだ。本当に確認しやすくなるかは、何を見られて、何が公表されるかで決まるよ。
ひよこ ひよこ
Accentureだけで評価するの? ほかの団体は?
ペンギン先生 ペンギン先生
独占ではないよ。今後数週間で他の評価者も発表するとしていて、研究団体のMETRなど非営利団体とも、各団体自身の資金で評価の一部を試す話し合いをしていると書いてあるんだ。話し合いの段階だから、まだ決まった取り組みではないよ。
ひよこ ひよこ
これって、この前のアモデイさんの話とつながってるの?
ペンギン先生 ペンギン先生
つながっているよ。Anthropicのページは、CEOの論稿『We Must Pace the Frontier』で示した取り組みに触れているんだ。三段階の提案の最初にあった、社内に外部評価者を入れる話を、実際の提携として発表した形だね。ただし細かい運用はこれから詰めて、状況に応じて変えていくと書かれているよ。
ひよこ ひよこ
ニュースでこういう発表を見たとき、何を見ればいいの?
ペンギン先生 ペンギン先生
三つ確かめよう。「見込み」の数字を確定額として読まないこと。評価者がどこまで見られて、何を公表できるのか。そして資金を出すのは誰か。第三者が入ることと、安全が保証されることは別の話だよ。今回の発表は評価の体制づくりの始まりで、AIが安全だと証明したものではないんだ。

出典・確認した情報

  • Accenture Newsroom — Accenture and Anthropic Partner to Build Team of Embedded Evaluators at Anthropic

    発表日: 2026-09-18 / 確認日: 2026-09-20

    • 2026年9月18日(ニューヨーク・サンフランシスコ)付の発表。AccentureとAnthropicが、Anthropicの社内チームと並んでモデルの評価・レッドチーミング、アラインメント評価、安全対策のテストを行う「組み込み評価者」チームを作る。
    • 評価者チームはAccentureが買収した応用AI企業Facultyの人員から構成。人数は発表内に記載がない。
    • 「各社が5年間で少なくとも10億ドルを投資する見込み」と、見込みの表現で記載。目的は安全なAI開発。
    • 実施の開始日は発表内に記載がない。
  • Anthropic — Partnering with Accenture on embedded evaluation

    発表日: 2026-09-18 / 確認日: 2026-09-20

    • 組み込み評価者は社員に近い水準のアクセスで、モデルの学習や公開の判断を見て社員と直接話し、安全の約束の確認や見落としの発見、インシデントの報告と公的な説明を担う。
    • Accentureの作業はAnthropicが直接資金提供する。METRなど非営利団体とは、各団体自身の資金で評価の一部を試験的に行う話し合いをしている。
    • Anthropicは、安全は引き続き自社の責任であり、独立した組み込み評価者は責任を減らさず、より確認しやすくするものと説明。
    • 評価者のアクセスや報告方法の標準はまだなく、資金は理想的には共同拠出や政府など会社単独ではない出どころが望ましいと認めている。
    • 独占的な提携ではなく、今後数週間で他の評価者を発表する予定。細かい運用は今後詰め、状況に応じて進化するとしている。CEOの論稿『We Must Pace the Frontier』で示した取り組みに関連づけている。