Industrie
AI Minute Newsroom
2026-08-25
Nvidia affirme que sa nouvelle baie abat 30 fois plus de travail d'agent par mégawatt — le test, c'est elle qui l'a mené, et les auteurs du banc d'essai n'ont pas encore validé
Le 24 août, Nvidia a publié des mesures sur silicium pour le Vera Rubin NVL72 : jusqu'à 30 fois plus de débit par mégawatt et jusqu'à 35 fois moins de coût par token que le GB300 NVL72 qu'il remplace. La charge utilisée est AgentX, de SemiAnalysis — des enregistrements de vraies séances de programmation agentique — exécutée sur Kimi K3, MiniMax M3, GLM 5.3, Qwen 3.5 et DeepSeek V4 Pro à des contextes dépassant 140 000 tokens. Nvidia indique que la plateforme est en pleine production, tout en précisant dans le même billet que les résultats attendent la revue de SemiAnalysis et n'intègrent pas encore les performances du processeur Vera sur les appels d'outils. La même semaine, à Hot Chips, elle a détaillé la baie : 2 zettaFLOPS d'inférence NVFP4 et 11 pétaoctets de HBM4 dans un bâtiment de 100 MW, refroidissement liquide à 45 °C, plateaux de calcul sans ventilateur ni câble.
Pourquoi c'est importantLa capacité d'IA se rationne désormais par l'électricité, pas par les puces : le matériel arrive en quelques mois, mais un raccordement au réseau se fait attendre des années. Un gain de 30 fois sur le travail par mégawatt, si des évaluateurs extérieurs le confirment, change la quantité d'IA qu'achète un contrat électrique donné, et c'est ce chiffre qui décide où s'implanteront les prochains bâtiments. Deux points à garder en tête : la mesure vient de Nvidia, sur du matériel Nvidia, avant relecture par les auteurs du banc d'essai — et tous les modèles testés sont chinois et à poids ouverts, ce qui dit discrètement ce que l'industrie considère aujourd'hui comme une vraie charge d'inférence.
✓ Vérifié · 2 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Le nouveau Mac Studio embarque 512 Go de mémoire adressable directement par le GPU : de quoi loger sous un bureau un modèle qui réclamait une baie
2026-08-25ByteDance a fondu son outil de codage et son constructeur d'agents dans une seule application, et l'a pointée vers le bureau
2026-08-25Les équipes de piratage liées à des États ont plus que doublé leur volume d'attaques dès qu'elles ont confié les tâches ingrates à un modèle
2026-08-25Un laboratoire a perdu les 40 000 puces sur lesquelles il devait entraîner. Il a donc vendu l'usine à celui qui les fabrique.
2026-08-25Les modèles qui s'étaient évadés de leur propre test pour tricher ont maintenant un procureur d'État qui réclame les journaux
2026-08-25