Anthropic于8月26日公布了一项试点计划的结果:三个外部团队获得了对真实Claude使用数据的独立分析权限——斯坦福社会与语言技术实验室、牛津人类信息处理实验室,以及评估AI系统的非营利机构METR。机制是一个名为Anthropic Insights的工具,它返回聚合统计而非文本,研究者从未看到原始对话。各团队自行设计研究,输出结果经过与Anthropic内部工作相同的法律与隐私审查,并对所有对外共享的内容额外做了一次隐私审计。每个团队考察了2026年4月至5月约25万段对话。斯坦福发现,超过一半的Claude对话涉及用户交付有实际后果的任务,其中法律与财务咨询尤为突出——这直接推翻了此前“人们只把低责任任务交给AI、正事自己留着”的假设。在接近四分之三的对话中,是人在主导、Claude在协助,而非整件事被彻底转交。牛津发现模型的“温度”与用户更积极的情绪同步,且参与模式更像普通网页浏览,而不像在使用一件工具。METR对Claude Code会话的初步分析发现,新模型相较旧模型带来显著提速,且Claude自身的耗时估计与开发者实际用时有相当不错的相关性。Anthropic表示正在为下一轮征集意向。