L'équipe d'ARC Prize a publié les résultats semi-privés vérifiés du modèle à poids ouverts V4 Flash 0731 de DeepSeek : 89,0 % à ARC-AGI-1 pour environ deux centimes par tâche, et 61,4 % à ARC-AGI-2 pour environ quatre centimes, au niveau de raisonnement maximal. Le modèle est un mélange d'experts de 284 milliards de paramètres qui n'en active que 13 milliards par token et gère un contexte d'un million de tokens. Le résultat s'est hissé en tête de Hacker News, où le rapport prix-performance a concentré l'attention.