aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-26

L'aperçu de Qwen4 est ouvert : six milliards de paramètres actifs par jeton et, dans le tableau publié par Alibaba, plus de vrais bugs corrigés qu'Opus 4.6

L'aperçu de Qwen4 est ouvert : six milliards de paramètres actifs par jeton et, dans le tableau publié par Alibaba, plus de vrais bugs corrigés qu'Opus 4.6

L'équipe Qwen d'Alibaba a ouvert les poids de Qwen3.8-Flash-Next, le modèle sur lequel elle avait lancé un compte à rebours ce matin. C'est un système multimodal à mélange d'experts : 125 milliards de paramètres dans le réseau principal, plus une table d'embeddings n-gram de 51 milliards et une couche de prédiction multi-jetons de 4 milliards — environ 180 milliards au total en BF16, dont à peu près 6 milliards sont actifs pour un jeton donné. L'architecture est inédite : un hybride de Gated DeltaNet et de Qwen Sparse Attention, 512 experts dont dix routés et un partagé, un résidu à porte, et une recette d'entraînement mêlant les optimiseurs Muon et AdamW. Le contexte est de 262 144 jetons en natif et s'étend jusqu'à un million. Le tableau publié par Qwen le place à 62,5 sur SWE-bench Pro contre 53,4 pour Claude Opus 4.6 Max, à 81,0 sur SWE-bench Multilingual contre 77,5, et à 58,7 sur DeepSWE 1.1 : ce sont les chiffres du laboratoire, sur son propre banc d'essai, sans reproduction indépendante à ce jour. L'équipe affirme que l'entraînement a coûté environ le neuvième de ce qu'a coûté Qwen3.7-Plus. Les poids sont sur Hugging Face et ModelScope sous licence qwen-community-1.0 : 131 fichiers, quelque 360 Go, avec une version FP8 qui divise la mémoire par deux. Qwen présente le modèle comme un aperçu précoce de l'architecture sur laquelle reposera Qwen4, et annonce une version hébergée à 0,16 dollar le million de jetons en entrée et 0,47 le million en sortie.

Pourquoi c'est importantLe chiffre qui compte n'est pas 62,5, c'est six milliards. Un modèle qui n'allume que six milliards de paramètres par jeton tourne à peu près à la vitesse d'un petit modèle tout en portant le savoir d'un grand : c'est pourquoi la version FP8 tient sur une seule station de travail bien équipée plutôt que sur une baie. Si les scores de programmation résistent à des tests indépendants, l'écart entre ce qu'on loue à un laboratoire de pointe et ce qu'on peut faire tourner soi-même se resserre encore — et il se resserre sur l'axe qui coûte de l'argent : les jetons par seconde et par watt. La réserve est claire : ce sont les propres mesures du fabricant, publiées le jour même que les poids, et la première chose à faire est de les vérifier.
#Code

✓ Vérifié · 4 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le modèle anonyme qui a avalé 42 000 milliards de jetons en six jours a un propriétaire : Z.ai reconnaît qu'Ox Alpha est un GLM et ouvre les poids
2026-08-26
Un agent qui continue de réfléchir quand vous arrêtez d'écrire — et tout le harnais tient en moins de 10 000 lignes de Bash
2026-08-26
Montrez au robot une vidéo d'une tâche de dix minutes, et il fait la tâche de dix minutes — sans réentraînement, sans rien taper
2026-08-26
Alibaba a lancé un compte à rebours sur la première pièce de Qwen4 — les poids s'ouvrent ce soir à 23 h, heure de Pékin
2026-08-26
Alibaba a mis en ligne la page d'un modèle qu'elle présente comme un avant-goût de l'architecture Qwen4, daté du 26 août — les specs sont apparues, puis ont disparu
2026-08-25