aiminute. ← Alle KI-News
Neue Modelle 2026-08-13

Nvidia trainiert ein Billionen-Parameter-Modell, das es verschenken will — und liegt bei der Größe schon zurück

Nvidia trainiert ein Billionen-Parameter-Modell, das es verschenken will — und liegt bei der Größe schon zurück

The Information berichtete am 11. August unter Berufung auf Mitarbeiter des Projekts, das größte Modell von Nvidias nächster offener Familie, Nemotron 4, werde mindestens eine Billion Parameter haben — etwa doppelt so viel wie die 550 Milliarden von Nemotron 3 Ultra. Das Training ist nicht abgeschlossen, ein Veröffentlichungsdatum gibt es nicht, doch Mitarbeiter sagten, es könne bereits im Spätherbst so weit sein. Nvidia gehört zu den wenigen großen US-Unternehmen, die noch offene Gewichte veröffentlichen; erklärtes Ziel ist es, Firmen ein westliches Modell zu geben, das sie herunterladen und auf eigener Hardware betreiben können, statt es über eine Schnittstelle zu mieten. Ein Rekord ist die Zahl nicht: Alibaba veröffentlichte diese Woche Qwen3.8-Max mit 2,4 Billionen Parametern, Moonshots Kimi K3 kam im Juli mit 2,8 Billionen. Nvidia hat sich öffentlich nicht zu dem Vorhaben geäußert.

Warum es wichtig istNvidia verkauft die Schaufeln — ein kostenloses Spitzenmodell ist für den Konzern also keine Produktlinie, sondern Nachfrageerzeugung für die Hardware, die man zum Betrieb eines solchen Modells braucht. Das macht es zu einer der seltenen Veröffentlichungen offener Gewichte mit einem Geschäftsmodell dahinter, das nicht davon abhängt, dass das Modell selbst Geld verdient. Interessanter als die Parameterzahl ist der Kontext: Die Spitze der offenen Gewichte ist inzwischen chinesisch, und westliche Firmen, die selbst hosten wollen, greifen mangels Alternative zu chinesischen Gewichten. Den Zeitplan bitte locker nehmen — es geht um einen unfertigen Trainingslauf, geschildert von Mitarbeitern, und solche Termine verschieben sich regelmäßig.

✓ Verifiziert · 3 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21
Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21
Das Modell erfindet seine eigenen Aufgaben, baut den Prüfstand dafür und trainiert dann mit dem Ergebnis — und DeepReinforce hat die Gewichte verschenkt
2026-08-20
Ein kostenloses Modell, das auf eine Grafikkarte passt, erreicht 52 — und verbraucht dann 22.276 Denk-Token für ein Bild
2026-08-18
Zhipu hat kein neues Modell gebaut. Es hat das alte weitertrainiert — und sagt, das Programmieren sei um 50 Prozent besser geworden
2026-08-17