Anthropic 首次让外部研究者通过隐私保护的 Anthropic Insights 分析真实 Claude 用量。斯坦福 SALT、牛津 HIP Lab 与 METR 独立研究了 2026 年 4–5 月约 25 万条 Claude.ai 或 Claude Code 对话,其中 METR 正在估算编程 Agent 的真实生产力增益。

核心要点速览 (Key Takeaways)

  • ✓三家外部机构分析约 25 万条 Claude.ai / Claude Code 对话;SALT 发现超过一半对话涉及影响他人或难以撤销的高后果任务
  • ✓METR 正基于 Claude Code 轨迹估算编程 Agent 生产力:初步显示更新模型节省更多时间,且 Claude 对任务耗时的估计与真实开发者耗时相关
  • ✓聚合数据已公开至 Hugging Face(Anthropic/enabling-independent-research),并开放下一轮研究者报名
🧭

阅读完核心要点?进一步了解模型实力与实际开销

7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算