エヌビディアは8月21日、AVO(Agentic Variation Operators)の結果を公表した。この汎用コーディングエージェント基盤は、対話型推論ベンチマークARC-AGI-3の公開セットにおいて、25環境すべての183レベルすべてを踏破し、人間比の行動効率を測る指標で100.00を記録した。これらの環境はエージェントに指示も明示的なルールも目標も与えない。何のゲームなのかを、遊びながら自分で突き止めるしかない。思考を担った言語モデルはAnthropicのClaude Opus 5で、同じモデルを高い推論強度で単体実行した場合、同じセットでの成績はおよそ30パーセントにとどまる。AVOが要した環境行動は6,624回で、従来最高のVISTAより約12パーセント少ない。エヌビディアは、この結果が25環境の公開セットのみを対象とし、準非公開または非公開の競技セットは含まないと明記している。