El equipo de ARC Prize publicó resultados semiprivados verificados del modelo de pesos abiertos V4 Flash 0731 de DeepSeek: 89,0% en ARC-AGI-1 a unos dos centavos por tarea y 61,4% en ARC-AGI-2 a unos cuatro centavos, con el máximo esfuerzo de razonamiento. El modelo es una mezcla de expertos de 284.000 millones de parámetros que solo activa 13.000 millones por token y maneja un contexto de un millón de tokens. El resultado escaló a lo más alto de Hacker News, donde la relación precio-rendimiento acaparó la conversación.