AI時短ラボ
検索
検証

Anthropic、外部研究者に「Claudeの実利用データ」を初めて開放Stanford・Oxford・METRの3チームが約25万件の会話をAnthropic Insights(旧Clio)で独立分析。会話の半数超で人は「結果が他人に及ぶ・取り消しにくい」仕事をAIに任せ、約4分の3で人が方向を決めAIが補助。Claudeが温かいと人は肯定的に、拒否には押し返す

執筆:約7分で読めます

Anthropicは2026年8月26日、外部の研究機関がClaudeの実利用データを独自の設問で分析する試験の結果を公開した。この春、StanfordのSALT Lab、OxfordのHuman Information Processing Lab、METRの3グループが、社内のプライバシー保護の分析ツールAnthropic Insights(旧Clio)で、2026年4〜5月のClaude.aiとClaude Codeの会話約25万件を分析した。Anthropicの審査権はプライバシー・悪用情報・機密・正確性に限り、結果に不都合でも公表できる。SALT Lab:会話の半数超で「他人に影響する・取り消しにくい」仕事を任せ、特に法務・金融の助言で多い。約4分の3で人が方向を決めClaudeが補助し、出力を手直しする。摩擦は多いが生産的。Oxford:Claudeが温かいと人は肯定的、拒否・反論には押し返し、風変わりだと知的に没入。METR:Claude Codeで新モデルほど時間短縮が大きいと暫定。集計データを公開し、研究者向けの関心表明フォームを用意。

Anthropic、外部研究者に「Claudeの実利用データ」を初めて開放──Stanford・Oxford・METRの3チームが約25万件の会話をAnthropic Insights(旧Clio)で独立分析。会話の半数超で人は「結果が他人に及ぶ・取り消しにくい」仕事をAIに任せ、約4分の3で人が方向を決めAIが補助。Claudeが温かいと人は肯定的に、拒否には押し返す
目次

2026年9月19日・日本時間時点の情報です。 Anthropicの研究記事(8月26日)を読んだ。当サイトはEconomic IndexのようなAnthropic自身の利用分析を追ってきたが、外部の研究者が自分の問いで同じデータを分析したのはこれが初で、結果が意外なので残す。

3行まとめ

  1. 仕組み。 実世界のAI利用データは少数のラボに集中し、外部研究者は「ラボが出す分析(ラボの問いに答える)」か「公開データ(カジュアルな利用に偏る)」しか使えない。この春、StanfordのSALT Lab・OxfordのHuman Information Processing Lab・METRの3グループが、Anthropicが社内で使うプライバシー保護の分析ツールAnthropic Insights(旧Clio)で、2026年4〜5月のClaude.aiとClaude Codeの会話約25万件を分析した。研究者は生の会話に触れず、社内と同じ法務・プライバシー審査を経た集計だけを見る。Anthropicの契約上の審査権はプライバシー・悪用に使える情報・機密・正確性に限り、結果の内容には関与せず、Anthropicに不都合でも公表できる。第三者の追加プライバシー監査も行った。
  2. 分かったこと。 SALT Lab:先行研究は「人は責任の軽い仕事だけAIに任せ、重い仕事は自分で」としたが、会話の半数超で「他人に影響する・取り消しにくい」仕事をClaudeに任せており、特に法務・金融の専門的助言を求める場面で多い。約4分の3で人が方向を決めClaudeが補助し、出力をそのまま使わず手直しする(ただし理解し学ぶ度合いは人による)。摩擦は多いが生産的──Claudeの試行を見て、指示の不明瞭さを見つけ、方向を直す過程が意図の明確化と出力の改善につながる。Oxford:Claudeが温かいと人は肯定的、拒否・反論には押し返し、風変わりだと知的に没入、単に助けると満足、という対応関係。没入・不満・楽しさの型は日常のWeb閲覧の研究と似る。METR:Claude Codeで「AIなしなら何分か」のClaudeの見積もりと実測を比べ、新しいモデルほど時間短縮が大きいと暫定。見積もりは過去の開発者研究の実測と相関。次は「AIが研究をどれだけ速めるか」。
  3. これから。 各研究の集計データを公開し、研究者向けの関心表明フォームを用意。運営側の学びは「利用者のプライバシーと研究者の独立の両方は守れたが、ラボの通常の研究速度に比べて遅く、資源を要する」で、拡大の課題として挙げる。

半数超が担う仕事の実感と限界

  • 「半数超が重い仕事を任せている」は、当サイトの読者層(AIを業務に使う人)の実感に近く、OpenAIの「Work at the frontier」が示した利用の深まりと同じ方向。ただし母集団はClaude.aiとClaude Codeの2か月分で、日本語の利用者比率は書かれていない
  • Oxfordの「Claudeの振る舞いと人の感情が対応する」は因果でなく共起。「温かくすると満足する」とは書かれていない
  • 「不都合でも公表できる」契約は、同じ週のOpenAIの10代研究助成や、9月のAccentureとの埋め込み評価と同じ「独立性の担保」の文言
  • METRの結果は「Claudeが見積もった時間」に依存し、本文も「AIなしの時間の推定」という方法の限界を認めている

確認は原文の集計、論文本体は未読

この記事の下調べで、筆者は9月19日にAnthropicの研究記事を取得し、3機関名・約25万件・4〜5月・審査権の範囲・半数超・約4分の3・Oxfordの対応関係・METRの暫定結果・集計データの公開がその原文にあることを確認した。各研究の全文と付録のプライバシー監査は開いていない。

内訳・公開時期・参加条件は未記載

  • 25万件の言語・地域の内訳
  • OxfordとMETRの完成版の公開時期
  • 拡大後の参加条件

出典はAnthropicの研究記事

関連記事

シェア: ポスト はてブ

出典・参照資料

AI時短ラボ

大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

関連記事

高給の仕事ほどAIを多く使っていた──Anthropicの100万会話分析「Cadences」を読むの記事画像動画

高給の仕事ほどAIを多く使っていた Anthropicの100万会話分析「Cadences」を読む

研究
How workers are unlocking new ways of working(OpenAI公式の画像)

OpenAIの経済調査「Work at the Frontier」第2弾 自分の職種外の仕事にAIを使う人は、翌月も同じ仕事に戻る(23.6%対8.4%)。150万メッセージで見えた「肩書きが変わる前に仕事が広がる」

研究
AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議の記事画像

AnthropicがAccentureと「埋め込み型の独立評価」で提携 評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議

検証
Anthropic社員のClaude Tag(Slack内のClaude)の使い方3つ──15件超のSlackスレッドを顧客向け1枚資料に45分(「この文書は事実か」と検証させ公式資料に合わせて書き直し)、機能要望を出した営業担当を26分で24件に集約、前週の不具合を50分で未解決23件・解決14件に整理、法務レビューは「3点は自分で検証できるはず」と言うと以後の規則に追加の記事画像

Anthropic社員のClaude Tag(Slack内のClaude)の使い方3つ 15件超のSlackスレッドを顧客向け1枚資料に45分(「この文書は事実か」と検証させ公式資料に合わせて書き直し)、機能要望を出した営業担当を26分で24件に集約、前週の不具合を50分で未解決23件・解決14件に整理、法務レビューは「3点は自分で検証できるはず」と言うと以後の規則に追加

検証(発表 8月28日)
OpenAI「Advisory Group on Mathematics and Artificial Intelligence」の告知画像動画

数学者はもう要らない? OpenAI「100以上の未解決問題を解決」を起点に、数学者自身が「まだ早い」と言っていた記録、4か月の快進撃、他の仕事との違い、3つの反論を一次ソースで並べる

研究
Claudeのメモリがチャットとコワークで統合──センシティブ話題は「後から」オンにしても過去分は保存されないの記事画像

Claudeのメモリがチャットとコワークで統合 センシティブ話題は「後から」オンにしても過去分は保存されない

プロダクト
数百万件の実ログが示す、海外のAI活用のリアル──OpenAIとAnthropicの一次データを読み比べるの記事画像

数百万件の実ログが示す、海外のAI活用のリアル OpenAIとAnthropicの一次データを読み比べる

研究
Anthropicの企業向け3本(9月10〜15日)──T. Rowe Priceが「銘柄を選ぶ人」から投資部門にClaude・Cowork・Claude Codeを拡大、Accentureと「パイロットから本番へ」(全社で持続的成果を出せた経営層は23%、AI費用の単独責任者がいない組織が42%)、営業組織ガイド(Coxは初年度7倍・精度18%→97%、Cyeraは88%が毎週利用)の記事画像

Anthropicの企業向け3本(9月10〜15日) T. Rowe Priceが「銘柄を選ぶ人」から投資部門にClaude・Cowork・Claude Codeを拡大、Accentureと「パイロットから本番へ」(全社で持続的成果を出せた経営層は23%、AI費用の単独責任者がいない組織が42%)、営業組織ガイド(Coxは初年度7倍・精度18%→97%、Cyeraは88%が毎週利用)

検証(発表 9月10日)