aiminute. ← 全部AI新闻
研究 2026-08-08

ARC Prize 验证 DeepSeek V4 Flash:ARC-AGI-2 得分 61%,每题仅四美分

ARC Prize 验证 DeepSeek V4 Flash:ARC-AGI-2 得分 61%,每题仅四美分

ARC Prize 团队公布了 DeepSeek 开源权重模型 V4 Flash 0731 的半私有验证结果:在最高推理强度下,ARC-AGI-1 得分 89.0%、每题约两美分;ARC-AGI-2 得分 61.4%、每题约四美分。该模型是 2840 亿参数的混合专家架构,每个 token 仅激活 130 亿参数,并支持 100 万 token 上下文。这一结果冲上 Hacker News 榜首,讨论最多的正是它的性价比。

为什么重要?ARC-AGI-2 的设计初衷就是抵御死记硬背、奖励真正的抽象推理;一个低激活参数的开源模型以白菜价拿下这样的分数,又抹平了开源与闭源 AI 之间的一道差距。对开发者而言,这意味着接近前沿的推理能力如今可以下载后自己运行,而不只是租用。

✓ 已核实 · 2个来源

▶ 相关视频: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

机器学习读懂了患病脑细胞的形态,挑出九种已获批药物让它们平静下来
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
这个智能体凭空造了第二个人来替自己的代码背书。德州一名 24 岁学生两个都不信。
2026-08-21
皮尤把五十万个网页送进检测器:ChatGPT 问世后发布的网页中,三分之一带有 AI 痕迹
2026-08-21
美国食品药品监督管理局已批准 1357 款人工智能医疗器械。其中只有三款检验过患者是否活得更久或更好。
2026-08-20