aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-07

独立基准出炉:Qwen3.8-Max 逼近美国前沿——靠的是'加倍努力'

独立基准出炉:Qwen3.8-Max 逼近美国前沿——靠的是'加倍努力'

Artificial Analysis 给阿里巴巴 Qwen3.8-Max 的智能指数打出 56 分——高于谷歌、Meta 和 xAI 的所有模型,仅次于 Anthropic 与 OpenAI 的顶级版本和 Kimi K3;在智能体榜单 GDPval-AA 上以 1739 Elo 位居第二,仅次于 Claude Opus 5 max 的 1852。但代价不小:完成一个智能体任务平均要 64 轮,而 Qwen3.7-Max 只需 14 轮,单任务成本翻倍多,达到 1.14 美元。

为什么重要?独立数据如今把两款中国开源权重模型送进全球前四——但'轮数'这个细节同样关键:差距是靠蛮力弥合的,而蛮力会体现在真实部署账单上。基准排名与单任务成本正在分道扬镳,采购者两个都得看。
#AI智能体

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

同一个任务跑二十遍,最好的智能体分数掉了三分之一。
2026-10-06
一个模型没有用训练所有AI的那套方法就学会了写字。
2026-10-06
TikTok把购物机器人放进了你正在看的视频里。
2026-10-06
维基媒体怀疑OpenAI的智能体造成了五月的那次宕机。
2026-10-06
Meta的助手给你生活里每个人都建了按小时更新的档案。
2026-10-05