8月22日的周末,Claude Code用户发帖称工具的“effort”(努力度)指示器显示出异常低的数值——有截图显示为100分中的10分——并称同样的任务在Opus 5和更早的Opus 4.6之间表现差异极大,某个案例中同一件工作用时43分钟对2分钟。该帖登上了Hacker News首页。Anthropic负责Claude Code团队的Thariq公开回复称,公司目前正在测试API服务配置,在测试期间数值化的努力度被“以不同方式映射”。他表示用户选择的努力度就是实际得到的努力度,公司自己的评估未显示性能下降。帖子的其余部分没那么容易了结:一长串用户描述Opus 5的输出比他们想要的更冗长、更繁复,有些人退回4.6或转向竞品工具。这些是印象而非测量,而关于模型质量的印象出了名的不可靠——但Anthropic确认的那件具体事情是:界面上显示的一个数字,本周的含义与上周不同。