El equipo de Kaiming He en el MIT resolvió ARC, una prueba visual de razonamiento abstracto. Tras preentrenar con imágenes naturales, el conjunto logró 70,2% frente al 71,6% de un sistema lingüístico. Los modelos punteros siguen por delante, con Gemini 3 Pro en 98% de la misma prueba.