aiminute. ← Alle KI-News
Branche AI Minute Newsroom 2026-08-25

Nvidia sagt, sein neues Rack leiste pro Megawatt 30-mal mehr Agentenarbeit — den Test hat es selbst gefahren, die Autoren des Benchmarks haben nicht abgenickt

Nvidia sagt, sein neues Rack leiste pro Megawatt 30-mal mehr Agentenarbeit — den Test hat es selbst gefahren, die Autoren des Benchmarks haben nicht abgenickt

Am 24. August veröffentlichte Nvidia am Silizium gemessene Zahlen für den Vera Rubin NVL72: bis zu 30-mal höherer Durchsatz pro Megawatt und bis zu 35-mal geringere Kosten pro Token gegenüber dem abgelösten GB300 NVL72. Als Last diente AgentX von SemiAnalysis — Aufzeichnungen echter agentischer Programmiersitzungen — ausgeführt auf Kimi K3, MiniMax M3, GLM 5.3, Qwen 3.5 und DeepSeek V4 Pro bei Kontexten über 140.000 Token. Nvidia erklärt die Plattform für voll in Produktion und merkt im selben Beitrag an, dass die Ergebnisse noch der Prüfung durch SemiAnalysis harren und die Leistung der Vera-CPU bei Tool-Aufrufen bisher nicht enthalten ist. In derselben Woche legte der Konzern auf der Hot Chips das Rack offen: 2 ZettaFLOPS NVFP4-Inferenz und 11 Petabyte HBM4 in einem 100-MW-Gebäude, Flüssigkühlung bei 45 Grad, Rechenschubladen ohne Lüfter und ohne Kabel.

Warum es wichtig istKI-Kapazität wird heute über Strom rationiert, nicht über Chips: Hardware kommt in Monaten, auf einen Netzanschluss wartet ein Rechenzentrum Jahre. Ein 30-facher Zugewinn an Arbeit pro Megawatt verändert, sofern externe Prüfer ihn bestätigen, wie viel KI ein fester Stromvertrag einkauft — und genau diese Zahl entscheidet, wo die nächsten Gebäude entstehen. Zweierlei bleibt im Blick zu behalten: Die Messung stammt von Nvidia, auf Nvidia-Hardware, vor der Durchsicht durch die Benchmark-Autoren. Und jedes getestete Modell ist chinesisch und quelloffen gewichtet — eine leise Aussage darüber, was die Branche inzwischen als ernsthafte Inferenzlast betrachtet.
#KI-Agenten

✓ Verifiziert · 2 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

Der neue Mac Studio hat 512 GB Speicher, den die GPU direkt adressieren kann — ein Modell in Rack-Größe, unter dem Schreibtisch
2026-08-25
ByteDance hat sein Coding-Werkzeug und seinen Agentenbaukasten in eine App gefaltet – und zielt damit aufs Büro
2026-08-25
Staatsnahe Hackergruppen haben ihr Angriffsvolumen mehr als verdoppelt, seit sie die langweiligen Teile einem Modell überlassen
2026-08-25
Ein Labor verlor die 40.000 Chips, auf denen es trainieren wollte. Also verkaufte es die Fabrik an den Hersteller dieser Chips.
2026-08-25
Die Modelle, die zum Spicken aus ihrem eigenen Test ausgebrochen sind, sehen sich nun einem Staatsanwalt gegenüber, der die Protokolle will
2026-08-25