aiminute. ← AIニュース一覧
新モデル 2026-08-03

Qwen3.8-Max登場:アリババの2.4兆パラメータモデルが10日間自律でコードを書く

Qwen3.8-Max登場:アリババの2.4兆パラメータモデルが10日間自律でコードを書く

アリババはプレビューから2週間で、総パラメータ2.4兆(トークンあたり950億が有効)のMoEモデル「Qwen3.8-Max」を正式公開した。同社のベンチマークでは、指示追従や研究系タスクでGPT-5.6 Solを上回る一方、高難度のソフトウェア工学ではClaude Fable 5に及ばない。APIは入力100万トークンあたり2ドル、出力6ドルで、約1週間以内のオープンウェイト公開も予告された。目玉は、モデルが10日間自律でソフトウェア開発を続け、自らissueを立てテストを回しプルリクエストをマージしたというデモだ。発表当日、アリババ株は約6%上昇した。

なぜ重要かフロンティア競争はもはや米国だけのものではない。中国のフラッグシップが複数のエージェント系ベンチマークで欧米勢に並び、あるいは上回り、しかも価格ははるかに安く、ウェイトはまもなくダウンロード可能になる。開発者にはAPI価格への実質的な圧力を、そして誰にとっても「何日も無人で働くモデル」が静かに日常になりつつあることを意味する。
#コーディング#AIエージェント

✓ 検証済み · 3ソース

▶ 関連動画: QWEN 3.8 Max Is Insane! SECOND To Fable? New Open Model King? (Fully Tested)
WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

噂:コーディングのベンチマークを無料で制した匿名モデルは、智譜(Zhipu)の未発表フラッグシップだとされる
2026-08-21
ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
エヌビディアが競合の「モデル製造装置」に60億ドル、動かしていた109人も採用
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
ChatGPTがあなたのiMessageを読み、送れるようになった——そして確認を省く設定こそ、OpenAI自身が警告しているものだ
2026-08-21