aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-08

ARC Prize 验证 DeepSeek V4 Flash:ARC-AGI-2 得分 61%,每题仅四美分

ARC Prize 验证 DeepSeek V4 Flash:ARC-AGI-2 得分 61%,每题仅四美分

ARC Prize 团队公布了 DeepSeek 开源权重模型 V4 Flash 0731 的半私有验证结果:在最高推理强度下,ARC-AGI-1 得分 89.0%、每题约两美分;ARC-AGI-2 得分 61.4%、每题约四美分。该模型是 2840 亿参数的混合专家架构,每个 token 仅激活 130 亿参数,并支持 100 万 token 上下文。这一结果冲上 Hacker News 榜首,讨论最多的正是它的性价比。

为什么重要?ARC-AGI-2 的设计初衷就是抵御死记硬背、奖励真正的抽象推理;一个低激活参数的开源模型以白菜价拿下这样的分数,又抹平了开源与闭源 AI 之间的一道差距。对开发者而言,这意味着接近前沿的推理能力如今可以下载后自己运行,而不只是租用。

✓ 已核实 · 2个来源

▶ 相关视频: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

一个模型没有用训练所有AI的那套方法就学会了写字。
2026-10-06
数学家用普通聊天框解决了五个未解难题
2026-10-05
没微调过的模型解开了微调版做不出的任务。
2026-10-04
用普通照片预训练的模型在推理测试拿到70%
2026-10-04
一个花八千美元训练的人工智能打败了西洋陆军棋最强棋手。
2026-10-03