Artificial Analysis attribue à Qwen3.8-Max d'Alibaba un score de 56 à son indice d'intelligence — au-dessus de tous les modèles de Google, Meta et xAI, seuls les hauts de gamme d'Anthropic et d'OpenAI et Kimi K3 faisant mieux — et la deuxième place de son classement agentique GDPval-AA avec 1739 Elo, derrière Claude Opus 5 max (1852). Le progrès a un coût : 64 tours en moyenne par tâche agentique contre 14 pour Qwen3.7-Max, soit un coût par tâche plus que doublé, à 1,14 dollar.