aiminute. ← AIニュース一覧
新モデル 2026-08-02

AMDのInstella-MoE:学習レシピを丸ごと公開したオープンモデル

AMDのInstella-MoE:学習レシピを丸ごと公開したオープンモデル

AMDは、総パラメータ160億のうちトークンごとに28億のみを使うMoE(専門家混合)モデル「Instella-MoE-16B-A3B」を公開した。学習は自社のInstinct MI300XとMI325X GPUのみで最初から最後まで行われた。異例なのは、全学習段階のチェックポイントに加え、データ配合、学習設定、コードまで公開した点だ——コードはMITライセンス、重みは研究限定ライセンス。AMDによれば、ベースモデルは完全オープンモデルの中で最高の平均スコアを記録し、Moonlight-16BやOLMo-3を上回る。

なぜ重要か多くの「オープン」モデルは重みしか公開しない。学習レシピ全体を含む公開は、研究者がモデルの作り方を実際に検証・再現できることを意味する——そしてNvidiaハードウェアなしでも競争力ある学習が可能だという実証でもある。

✓ 検証済み · 3ソース

▶ 関連動画: AMD Releases First Ever AI model: Instella-MoE-16B-A3B-Think
WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
ロボットに一度見せるだけ——3秒から12秒——訓練なしで100回中59回、仕事をこなす
2026-08-21
モデルが自分で課題を作り、それを試す装置まで組み、その結果で自分を訓練する——DeepReinforce は重みも無償公開した
2026-08-20
グラフィックカード1枚に収まる無料モデルが52点を取り、そして絵を1枚描くのに2万2276の思考トークンを費やす
2026-08-18
智譜は新しいモデルを作らなかった。古いモデルを訓練し続けただけで、コーディング性能が50%向上したという
2026-08-17