彭博行业研究说,中美顶尖模型的差距已经是它追踪过的最小值。在智能体写代码那一项,DeepSeek 反超了:77.3 比 66.1。总分它拿 81.1,Anthropic 是 83.4;五月时差距还有百分之九。
✓ 已核实 · 2个来源