aiminute. ← Alle KI-News
Neue Modelle 2026-08-02

AMDs Instella-MoE: ein offenes Modell samt komplettem Trainingsrezept

AMDs Instella-MoE: ein offenes Modell samt komplettem Trainingsrezept

AMD hat Instella-MoE-16B-A3B veröffentlicht, ein Mixture-of-Experts-Modell mit insgesamt 16 Milliarden Parametern, von denen pro Token nur 2,8 Milliarden aktiv sind — durchgängig trainiert auf AMDs eigenen Instinct-GPUs MI300X und MI325X. Ungewöhnlich: Die Veröffentlichung umfasst Checkpoints jeder Trainingsphase sowie Datenmischungen, Trainingskonfigurationen und Code — der Code unter MIT-Lizenz, die Gewichte unter einer reinen Forschungslizenz. Laut AMD erzielt das Basismodell den besten Durchschnitt unter vollständig offenen Modellen, vor Moonlight-16B und OLMo-3.

Warum es wichtig istDie meisten 'offenen' Modelle liefern nur Gewichte. Eine Veröffentlichung mit dem gesamten Trainingsrezept erlaubt Forschern, den Bau eines Modells wirklich zu studieren und zu reproduzieren — und beweist, dass konkurrenzfähiges Training komplett ohne Nvidia-Hardware möglich ist.

✓ Verifiziert · 3 Quellen

▶ Passendes Video: AMD Releases First Ever AI model: Instella-MoE-16B-A3B-Think
WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21
Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21
Das Modell erfindet seine eigenen Aufgaben, baut den Prüfstand dafür und trainiert dann mit dem Ergebnis — und DeepReinforce hat die Gewichte verschenkt
2026-08-20
Ein kostenloses Modell, das auf eine Grafikkarte passt, erreicht 52 — und verbraucht dann 22.276 Denk-Token für ein Bild
2026-08-18
Zhipu hat kein neues Modell gebaut. Es hat das alte weitertrainiert — und sagt, das Programmieren sei um 50 Prozent besser geworden
2026-08-17