aiminute. ← Toute l’actu IA
Nouveaux Modèles 2026-08-02

Instella-MoE d'AMD : un modèle ouvert livré avec sa recette d'entraînement complète

Instella-MoE d'AMD : un modèle ouvert livré avec sa recette d'entraînement complète

AMD a publié Instella-MoE-16B-A3B, un modèle à mélange d'experts de 16 milliards de paramètres au total qui n'en active que 2,8 milliards par token, entraîné de bout en bout sur ses propres GPU Instinct MI300X et MI325X. Fait inhabituel : la publication inclut les checkpoints de chaque étape d'entraînement, les mélanges de données, les configurations et le code — le code sous licence MIT, les poids sous licence réservée à la recherche. AMD affirme que le modèle de base obtient la meilleure moyenne parmi les modèles entièrement ouverts, devant Moonlight-16B et OLMo-3.

Pourquoi c'est importantLa plupart des modèles « ouverts » ne livrent que leurs poids. Une publication incluant toute la recette d'entraînement permet aux chercheurs d'étudier et de reproduire réellement la fabrication d'un modèle — et prouve qu'un entraînement compétitif peut se faire entièrement sans matériel Nvidia.

✓ Vérifié · 3 sources

▶ Vidéo associée: AMD Releases First Ever AI model: Instella-MoE-16B-A3B-Think
WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21
Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21
Le modèle invente ses propres exercices, construit le banc d'essai qui les évalue, puis s'entraîne sur le résultat — et DeepReinforce a donné les poids
2026-08-20
Un modèle gratuit qui tient sur une seule carte graphique obtient 52 — puis dépense 22 276 jetons de réflexion pour dessiner une image
2026-08-18
Zhipu n'a pas construit un nouveau modèle. Elle a continué d'entraîner l'ancien — et affirme que le code s'est amélioré de 50 %
2026-08-17