aiminute. ← Toute l’actu IA
Recherche AI Minute Newsroom 2026-08-07

Benchmarks indépendants : Qwen3.8-Max juste sous la frontière américaine — au prix d'un effort bien plus grand

Benchmarks indépendants : Qwen3.8-Max juste sous la frontière américaine — au prix d'un effort bien plus grand

Artificial Analysis attribue à Qwen3.8-Max d'Alibaba un score de 56 à son indice d'intelligence — au-dessus de tous les modèles de Google, Meta et xAI, seuls les hauts de gamme d'Anthropic et d'OpenAI et Kimi K3 faisant mieux — et la deuxième place de son classement agentique GDPval-AA avec 1739 Elo, derrière Claude Opus 5 max (1852). Le progrès a un coût : 64 tours en moyenne par tâche agentique contre 14 pour Qwen3.7-Max, soit un coût par tâche plus que doublé, à 1,14 dollar.

Pourquoi c'est importantLes chiffres indépendants placent désormais deux modèles chinois à poids ouverts dans le top 4 mondial — mais le détail des tours compte autant : l'écart se comble à la force brute, et cet effort se retrouve sur les factures réelles de déploiement. Classement et coût par tâche divergent ; il faut lire les deux.
#Agents IA

✓ Vérifié · 2 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Vingt essais sur la même tâche coûtent un tiers au meilleur agent.
2026-10-06
Un modèle a appris sans la méthode qui entraîne toutes les IA.
2026-10-06
TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06
Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06
L'assistant de Meta tient une fiche horaire sur vos proches.
2026-10-05