aiminute. ← AIニュース一覧
新モデル AI Minute Newsroom 2026-08-11

エヌビディアの新しいオープンモデルは300億パラメータだが一度に使うのは30億——しかもデスクトップで動く

エヌビディアの新しいオープンモデルは300億パラメータだが一度に使うのは30億——しかもデスクトップで動く

エヌビディアは8月11日、Nemotron 3.5 Lightningを公開した。300億パラメータの混合エキスパート(MoE)モデルで、トークンごとに有効化されるのは30億パラメータのみ。コンテキストウィンドウは最大100万トークン、重みは寛容なOpenMDW-1.1ライセンスの下にあり、企業はエヌビディアの許可を得ずにダウンロード・改変・製品化できる。狙いはエージェント業務の地味な半分だ。コードレビュー、ツール呼び出し、セキュリティ警告の監視、請求に関する問い合わせ対応——フロンティアモデルが計画はしても自ら実行する必要のない工程である。エヌビディアは同クラスのモデルに対し最大4倍の出力速度、エージェントのタスク完了で30%高速と主張し、MMLU Pro 81.62、GPQA Diamond 75.57、SWE-bench Verified 52.80を報告している。RTX PC、DGX Spark、DGX Station、Jetsonボード上でローカルに動作し、データセンターにも拡張可能で、Hugging Face、ModelScope、OpenRouterで入手できる。同時にエヌビディアはNeMo Switchyardもオープンソース化した。ワークフローの各ステップを、それを処理できる最も安いモデルに振り分けるルーティングライブラリだ。エヌビディア自身のベンチマークでは、Switchyard経由の構成はすべてをOpus 4.8で処理する場合の約3分の1のコストになるという。

なぜ重要か重要なのはモデルよりルーターかもしれない。エヌビディアの主張はこうだ——高価なフロンティアモデルは計画だけを担い、それ以外はほとんど担うべきでない。エージェントが実際にやっている仕事の大半は小さく反復的で、ワークステーションに収まるモデルに任せられるからだ。これはエヌビディアがチップを売っている相手であるラボのトークン課金ビジネスへの直接攻撃であり、しかもその主張の両輪を同じ日に無償で出してきた。限られた予算でエージェントを動かす人——学校の研究室、小さなチーム、個人開発者——にとっての実際的な意味は、ローカルモデルという選択肢に本格的な候補が加わり、そのライセンスは誰の許可も要らないということだ。
#コーディング#AIエージェント

✓ 検証済み · 3ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

TikTokが見ている動画の中に買い物ボットを入れました。
2026-10-06
Reflectionが5010億パラメータのモデルを無料で配ります。
2026-10-06
ウィキメディアがOpenAIのエージェントを5月の障害で疑っています。
2026-10-06
マイクロソフトの新モデルは話し終わる前に書き始めます。
2026-10-05
米国の研究所が中国勢に並ぶ公開モデルを無料で出します。
2026-10-05