アリババの通義MAIチームは8月20日、Qwen-UI-Agentを公開した。質問に答えるためではなく画面を操作するために作られたモデルで、スマートフォン、デスクトップ、ブラウザ、コマンドラインを一つの系に収める。チームはシミュレーションだけで訓練せず、150以上のアプリをカバーする100台超の実機スマートフォンによる稼働環境を用意し、実機上の400以上のタスクからなるベンチマークMobileWorld-Realを構築した。報告値はMobileWorld-Realで92.2%、AndroidDailyで97.5%、OSWorld-Verifiedで79.5%、WebArenaで73.6%。モバイルとブラウザの作業ではClaude Opus 4.8やGPT-5.6を上回る。ただしより難しいOSWorld-v2ではOpusが54.8対40で先行する。小型のMAI-UI 2Bと8BはApache 2.0でHugging Faceに公開されている。