Anthropic、外部研究者に「Claudeの実利用データ」を初めて開放Stanford・Oxford・METRの3チームが約25万件の会話をAnthropic Insights(旧Clio)で独立分析。会話の半数超で人は「結果が他人に及ぶ・取り消しにくい」仕事をAIに任せ、約4分の3で人が方向を決めAIが補助。Claudeが温かいと人は肯定的に、拒否には押し返す
Anthropicは2026年8月26日、外部の研究機関がClaudeの実利用データを独自の設問で分析する試験の結果を公開した。この春、StanfordのSALT Lab、OxfordのHuman Information Processing Lab、METRの3グループが、社内のプライバシー保護の分析ツールAnthropic Insights(旧Clio)で、2026年4〜5月のClaude.aiとClaude Codeの会話約25万件を分析した。Anthropicの審査権はプライバシー・悪用情報・機密・正確性に限り、結果に不都合でも公表できる。SALT Lab:会話の半数超で「他人に影響する・取り消しにくい」仕事を任せ、特に法務・金融の助言で多い。約4分の3で人が方向を決めClaudeが補助し、出力を手直しする。摩擦は多いが生産的。Oxford:Claudeが温かいと人は肯定的、拒否・反論には押し返し、風変わりだと知的に没入。METR:Claude Codeで新モデルほど時間短縮が大きいと暫定。集計データを公開し、研究者向けの関心表明フォームを用意。

2026年9月19日・日本時間時点の情報です。 Anthropicの研究記事(8月26日)を読んだ。当サイトはEconomic IndexのようなAnthropic自身の利用分析を追ってきたが、外部の研究者が自分の問いで同じデータを分析したのはこれが初で、結果が意外なので残す。
3行まとめ
- 仕組み。 実世界のAI利用データは少数のラボに集中し、外部研究者は「ラボが出す分析(ラボの問いに答える)」か「公開データ(カジュアルな利用に偏る)」しか使えない。この春、StanfordのSALT Lab・OxfordのHuman Information Processing Lab・METRの3グループが、Anthropicが社内で使うプライバシー保護の分析ツールAnthropic Insights(旧Clio)で、2026年4〜5月のClaude.aiとClaude Codeの会話約25万件を分析した。研究者は生の会話に触れず、社内と同じ法務・プライバシー審査を経た集計だけを見る。Anthropicの契約上の審査権はプライバシー・悪用に使える情報・機密・正確性に限り、結果の内容には関与せず、Anthropicに不都合でも公表できる。第三者の追加プライバシー監査も行った。
- 分かったこと。 SALT Lab:先行研究は「人は責任の軽い仕事だけAIに任せ、重い仕事は自分で」としたが、会話の半数超で「他人に影響する・取り消しにくい」仕事をClaudeに任せており、特に法務・金融の専門的助言を求める場面で多い。約4分の3で人が方向を決めClaudeが補助し、出力をそのまま使わず手直しする(ただし理解し学ぶ度合いは人による)。摩擦は多いが生産的──Claudeの試行を見て、指示の不明瞭さを見つけ、方向を直す過程が意図の明確化と出力の改善につながる。Oxford:Claudeが温かいと人は肯定的、拒否・反論には押し返し、風変わりだと知的に没入、単に助けると満足、という対応関係。没入・不満・楽しさの型は日常のWeb閲覧の研究と似る。METR:Claude Codeで「AIなしなら何分か」のClaudeの見積もりと実測を比べ、新しいモデルほど時間短縮が大きいと暫定。見積もりは過去の開発者研究の実測と相関。次は「AIが研究をどれだけ速めるか」。
- これから。 各研究の集計データを公開し、研究者向けの関心表明フォームを用意。運営側の学びは「利用者のプライバシーと研究者の独立の両方は守れたが、ラボの通常の研究速度に比べて遅く、資源を要する」で、拡大の課題として挙げる。
半数超が担う仕事の実感と限界
- 「半数超が重い仕事を任せている」は、当サイトの読者層(AIを業務に使う人)の実感に近く、OpenAIの「Work at the frontier」が示した利用の深まりと同じ方向。ただし母集団はClaude.aiとClaude Codeの2か月分で、日本語の利用者比率は書かれていない
- Oxfordの「Claudeの振る舞いと人の感情が対応する」は因果でなく共起。「温かくすると満足する」とは書かれていない
- 「不都合でも公表できる」契約は、同じ週のOpenAIの10代研究助成や、9月のAccentureとの埋め込み評価と同じ「独立性の担保」の文言
- METRの結果は「Claudeが見積もった時間」に依存し、本文も「AIなしの時間の推定」という方法の限界を認めている
確認は原文の集計、論文本体は未読
この記事の下調べで、筆者は9月19日にAnthropicの研究記事を取得し、3機関名・約25万件・4〜5月・審査権の範囲・半数超・約4分の3・Oxfordの対応関係・METRの暫定結果・集計データの公開がその原文にあることを確認した。各研究の全文と付録のプライバシー監査は開いていない。
内訳・公開時期・参加条件は未記載
- 25万件の言語・地域の内訳
- OxfordとMETRの完成版の公開時期
- 拡大後の参加条件
出典はAnthropicの研究記事
- Enabling independent research on how people use Claude(Anthropic・2026年8月26日)
関連記事
出典・参照資料
大きいニュースはYouTubeでも解説しています。Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →