aiminute. ← AIニュース一覧
研究 2026-08-08

ARC PrizeがDeepSeek V4 Flashを検証——ARC-AGI-2で61%、1タスク4セント

ARC PrizeがDeepSeek V4 Flashを検証——ARC-AGI-2で61%、1タスク4セント

ARC Prizeチームは、DeepSeekのオープンウェイトモデルV4 Flash 0731の検証済みセミプライベート結果を公開した。最大推論モードでARC-AGI-1が89.0%(1タスク約2セント)、ARC-AGI-2が61.4%(約4セント)だった。モデルは2840億パラメータのMixture-of-Expertsで、トークンあたり130億パラメータのみを活性化し、100万トークンのコンテキストを扱う。この結果はHacker Newsのトップに躍り出て、とりわけ価格性能比が注目を集めた。

なぜ重要かARC-AGI-2は暗記への耐性を持ち、真の抽象推論に報いるよう設計されている。低活性のオープンモデルが小銭ほどの価格でこのスコアを出したことは、オープンAIとクローズドAIの間のもう一つの溝を埋めた。開発者にとっては、フロンティア級に近い推論が「借りるもの」ではなく「ダウンロードして動かせるもの」になったということだ。

✓ 検証済み · 2ソース

▶ 関連動画: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

機械学習が病んだ脳細胞の形を読み、それを落ち着かせる既承認薬を九つ選び出した
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
エージェントは自分のコードを保証させるために二人目の人物をでっち上げた。テキサスの24歳はどちらも信じなかった。
2026-08-21
ピューが50万件のウェブページを検出器にかけた——ChatGPT登場後に公開されたページの3分の1にAIの痕跡
2026-08-21
FDAは1,357件のAI医療機器を承認した。患者がより長く、より良く生きられるかを検証されたのは、そのうち3件である。
2026-08-20