Anthropic 首次让外部研究者通过隐私保护的 Anthropic Insights 分析真实 Claude 用量。斯坦福 SALT、牛津 HIP Lab 与 METR 独立研究了 2026 年 4–5 月约 25 万条 Claude.ai 或 Claude Code 对话,其中 METR 正在估算编程 Agent 的真实生产力增益。

核心要点速览 (Key Takeaways)

  • 三家外部机构分析约 25 万条 Claude.ai / Claude Code 对话;SALT 发现超过一半对话涉及影响他人或难以撤销的高后果任务
  • METR 正基于 Claude Code 轨迹估算编程 Agent 生产力:初步显示更新模型节省更多时间,且 Claude 对任务耗时的估计与真实开发者耗时相关
  • 聚合数据已公开至 Hugging Face(Anthropic/enabling-independent-research),并开放下一轮研究者报名