aiminute. ← Alle KI-News
Neue Modelle 2026-08-11

Nvidias neues offenes Modell hat 30 Milliarden Parameter und nutzt 3 davon gleichzeitig — und es läuft auf einem Desktop

Nvidias neues offenes Modell hat 30 Milliarden Parameter und nutzt 3 davon gleichzeitig — und es läuft auf einem Desktop

Nvidia hat am 11. August Nemotron 3.5 Lightning veröffentlicht: ein Mixture-of-Experts-Modell mit 30 Milliarden Parametern, von denen pro Token nur 3 Milliarden aktiviert werden, mit einem Kontextfenster von bis zu einer Million Token und Gewichten unter der freizügigen Lizenz OpenMDW-1.1 — Unternehmen dürfen es herunterladen, verändern und darauf aufbauen, ohne Nvidia zu fragen. Gedacht ist es für die unglamouröse Hälfte der Agentenarbeit: Code-Review, Werkzeugaufrufe, Überwachung von Sicherheitswarnungen, Beantwortung von Abrechnungsfragen — also die Schritte, die ein Frontier-Modell zwar plant, aber nicht selbst ausführen muss. Nvidia beansprucht bis zur vierfachen Ausgabegeschwindigkeit und 30 % schnellere Erledigung agentischer Aufgaben gegenüber Modellen vergleichbarer Größe und nennt 81,62 auf MMLU Pro, 75,57 auf GPQA Diamond und 52,80 auf SWE-bench Verified. Es läuft lokal auf RTX-PCs, DGX Spark, DGX Station und Jetson-Boards, skaliert aber auch ins Rechenzentrum, und ist über Hugging Face, ModelScope und OpenRouter verfügbar. Zusätzlich hat Nvidia NeMo Switchyard quelloffen gemacht, eine Routing-Bibliothek, die jeden Schritt eines Arbeitsablaufs an das günstigste Modell schickt, das ihn bewältigen kann; nach Nvidias eigenen Messungen kostet ein über Switchyard geroutetes Setup knapp ein Drittel dessen, was es kostet, alles mit Opus 4.8 zu erledigen.

Warum es wichtig istDer Router könnte wichtiger sein als das Modell. Nvidias Argument lautet: Das teure Frontier-System soll planen und sonst fast nichts — denn das meiste, was ein Agent tatsächlich tut, ist kleinteilige, wiederholte Arbeit, die man an etwas abgeben kann, das auf eine Workstation passt. Das ist ein direkter Angriff auf das Token-Geschäft jener Labore, denen Nvidia Chips verkauft, und Nvidia hat beide Hälften des Arguments an einem Tag kostenlos ausgeliefert. Wer mit knappem Budget Agenten betreibt — ein Schullabor, ein kleines Team, ein einzelner Entwickler —, kann es praktisch so lesen: Die Option lokales Modell hat einen ernsthaften Kandidaten dazubekommen, unter einer Lizenz, die niemandes Erlaubnis verlangt.
#Coding#KI-Agenten

✓ Verifiziert · 3 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

Gerücht: Das anonyme Modell, das gerade gratis einen Coding-Benchmark anführte, soll Zhipus unveröffentlichtes Spitzenmodell sein
2026-08-21
DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21
Nvidia zahlt 6 Milliarden Dollar für die Maschine, die die Modelle eines Konkurrenten baut — und stellt 109 der Leute ein, die sie bedienten
2026-08-21
Vier Stunden und eine GPU, um die Art zu verbessern, wie KI trainiert wird: Der beste Agent kam auf 0,25 von 1 — und die meisten versuchten es gar nicht erst
2026-08-21
ChatGPT kann jetzt Ihre iMessages lesen und verschicken — und die Einstellung, mit der es das Nachfragen überspringt, ist genau die, vor der OpenAI warnt
2026-08-21