Recherche
2026-08-07
Benchmarks indépendants : Qwen3.8-Max juste sous la frontière américaine — au prix d'un effort bien plus grand
Artificial Analysis attribue à Qwen3.8-Max d'Alibaba un score de 56 à son indice d'intelligence — au-dessus de tous les modèles de Google, Meta et xAI, seuls les hauts de gamme d'Anthropic et d'OpenAI et Kimi K3 faisant mieux — et la deuxième place de son classement agentique GDPval-AA avec 1739 Elo, derrière Claude Opus 5 max (1852). Le progrès a un coût : 64 tours en moyenne par tâche agentique contre 14 pour Qwen3.7-Max, soit un coût par tâche plus que doublé, à 1,14 dollar.
Pourquoi c'est importantLes chiffres indépendants placent désormais deux modèles chinois à poids ouverts dans le top 4 mondial — mais le détail des tours compte autant : l'écart se comble à la force brute, et cet effort se retrouve sur les factures réelles de déploiement. Classement et coût par tâche divergent ; il faut lire les deux.
✓ Vérifié · 2 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
L'apprentissage automatique a lu la forme de cellules cérébrales malades et retenu neuf médicaments déjà autorisés qui les ont apaisées
2026-08-21Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21