Neue Modelle
AI Minute Newsroom
2026-08-02
AMDs Instella-MoE: ein offenes Modell samt komplettem Trainingsrezept
AMD hat Instella-MoE-16B-A3B veröffentlicht, ein Mixture-of-Experts-Modell mit insgesamt 16 Milliarden Parametern, von denen pro Token nur 2,8 Milliarden aktiv sind — durchgängig trainiert auf AMDs eigenen Instinct-GPUs MI300X und MI325X. Ungewöhnlich: Die Veröffentlichung umfasst Checkpoints jeder Trainingsphase sowie Datenmischungen, Trainingskonfigurationen und Code — der Code unter MIT-Lizenz, die Gewichte unter einer reinen Forschungslizenz. Laut AMD erzielt das Basismodell den besten Durchschnitt unter vollständig offenen Modellen, vor Moonlight-16B und OLMo-3.
Warum es wichtig istDie meisten 'offenen' Modelle liefern nur Gewichte. Eine Veröffentlichung mit dem gesamten Trainingsrezept erlaubt Forschern, den Bau eines Modells wirklich zu studieren und zu reproduzieren — und beweist, dass konkurrenzfähiges Training komplett ohne Nvidia-Hardware möglich ist.
✓ Verifiziert · 3 Quellen
▶ Passendes Video: AMD Releases First Ever AI model: Instella-MoE-16B-A3B-Think
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Reflection verschenkt ein Modell mit 501 Milliarden Parametern.
2026-10-06Microsofts neues Modell schreibt, bevor Sie fertig gesprochen haben.
2026-10-05Ein US-Labor verschenkt bald ein Modell auf Chinas Niveau.
2026-10-05Eine Videoseite verschenkt das beste offene Übersetzungsmodell.
2026-10-05Die Hälfte der Angerufenen hielt die KI für einen Menschen.
2026-10-04