aiminute. ← AIニュース一覧
研究 AI Minute Newsroom 2026-08-23

270億パラメータのモデルが、論文の再現でOpus 4.8とGPT-5.5を上回った

270億パラメータのモデルが、論文の再現でOpus 4.8とGPT-5.5を上回った

グーグルDeepMind出身者が創業した十数人のロンドンの研究所Inherentは8月22日、自社エージェントFaradayが公表済みの科学的知見を、アンソロピックのClaude Opus 4.8やオープンAIのGPT-5.5より忠実に再現すると発表した。Faradayは公開モデルであるQwen 3.6(270億パラメータ)の上で動き、長期視野の強化学習で訓練された。評価基準はInherent自作のReplicaで、自然言語処理・材料科学・気象予測の論文100本から取り出した310課題からなる。各課題は、元の図を一度も見ずに、限られた時間と計算資源のもとで図を再現するよう求める。Inherentは全カテゴリで首位とし、差が最も大きいのはメタ学習、構造生物学、材料科学だとしている。同研究所は2026年5月に5000万ドルのシードでステルスを脱したが、真に新しい発見はまだ示していない。

なぜ重要かまず留保が二つ。ベンチマークは自社製であり、再現は発見ではない。それでも注目すべきは規模だ。適切に訓練された270億の公開モデルが、おそらく百倍規模のシステムを、記憶ではなく粘りを要する課題で上回った。論文を読み、著者が書き落とした手順を推測し、図が戻ってくるまで回し続ける作業である。これは大学の研究室でも回せる負荷だ。
#AIエージェント#科学・研究

✓ 検証済み · 3ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

アリババは実機のスマホ100台を並べてモデルを訓練した——実機で100タスク中92を完了する
2026-08-23
OpenAI が Codex の下にあるエンジンを無償公開した。そして自社の数字は、エンジンのほうがモデルより価値があると言っている
2026-08-22
未発表論文の参考文献リストだけを渡して、その論文が何を言っているか当てさせる。最良のモデルでも正答率は15%だ。
2026-08-22
グーグルのオープンモデルは10億回ダウンロードされ、外部の人々が10万通りの派生版を作った
2026-08-22
米国人の四分の三は近くにデータセンターを望まない。一年前は賛否が拮抗していた。
2026-08-22