AMD, toplam 16 milyar parametreli ama jeton başına yalnızca 2,8 milyarını çalıştıran uzman-karışımı (MoE) modeli Instella-MoE-16B-A3B'yi yayınladı; model baştan sona AMD'nin kendi Instinct MI300X ve MI325X GPU'larında eğitildi. Alışılmadık biçimde paket, her eğitim aşamasının ara kayıtlarını, veri karışımlarını, eğitim ayarlarını ve kodu içeriyor — kod MIT lisanslı, ağırlıklar yalnızca araştırma lisanslı. AMD, taban modelin tam açık modeller arasında Moonlight-16B ve OLMo-3'ün önünde en yüksek ortalamayı tutturduğunu söylüyor.