aiminute. ← Toute l’actu IA
Recherche AI Minute Newsroom 2026-08-08

ARC Prize vérifie DeepSeek V4 Flash : 61 % à ARC-AGI-2 pour quatre centimes la tâche

ARC Prize vérifie DeepSeek V4 Flash : 61 % à ARC-AGI-2 pour quatre centimes la tâche

L'équipe d'ARC Prize a publié les résultats semi-privés vérifiés du modèle à poids ouverts V4 Flash 0731 de DeepSeek : 89,0 % à ARC-AGI-1 pour environ deux centimes par tâche, et 61,4 % à ARC-AGI-2 pour environ quatre centimes, au niveau de raisonnement maximal. Le modèle est un mélange d'experts de 284 milliards de paramètres qui n'en active que 13 milliards par token et gère un contexte d'un million de tokens. Le résultat s'est hissé en tête de Hacker News, où le rapport prix-performance a concentré l'attention.

Pourquoi c'est importantARC-AGI-2 a été conçu pour résister à la mémorisation et récompenser le vrai raisonnement abstrait ; qu'un modèle ouvert à faible activation atteigne un tel score pour quelques centimes comble un fossé de plus entre IA ouverte et fermée. Pour les développeurs, le raisonnement quasi-frontière devient quelque chose qu'on télécharge et qu'on exécute — plus seulement qu'on loue.

✓ Vérifié · 2 sources

▶ Vidéo associée: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Un modèle a appris sans la méthode qui entraîne toutes les IA.
2026-10-06
Cinq problèmes ouverts sont tombés dans un chat ordinaire.
2026-10-05
Les modèles bruts ont réussi des tâches que leur version polie rate.
2026-10-04
Un modèle nourri de photos banales atteint 70% en raisonnement.
2026-10-04
Une IA entraînée pour 8 000 dollars a battu le maître du Stratego.
2026-10-03