aiminute. ← Alle KI-News
Forschung AI Minute Newsroom 2026-08-07

Unabhängige Benchmarks: Qwen3.8-Max liegt knapp unter der US-Spitze — durch viel mehr Arbeit

Unabhängige Benchmarks: Qwen3.8-Max liegt knapp unter der US-Spitze — durch viel mehr Arbeit

Artificial Analysis bewertete Alibabas Qwen3.8-Max mit 56 Punkten auf seinem Intelligence Index — über allen Modellen von Google, Meta und xAI; nur die Topmodelle von Anthropic und OpenAI sowie Kimi K3 liegen darüber. Auf der agentischen GDPval-AA-Rangliste steht es mit 1739 Elo auf Platz zwei hinter Claude Opus 5 max (1852). Der Fortschritt hat seinen Preis: Im Schnitt braucht es 64 Züge pro Agentenaufgabe statt 14 bei Qwen3.7-Max — die Kosten pro Aufgabe verdoppeln sich auf 1,14 Dollar.

Warum es wichtig istUnabhängige Zahlen setzen nun zwei chinesische Open-Weight-Modelle in die globalen Top 4 — doch das Zug-Detail wiegt genauso schwer: Die Lücke wird mit roher Anstrengung geschlossen, und die taucht auf echten Rechnungen auf. Benchmark-Rang und Kosten pro Aufgabe driften auseinander; Käufer sollten beides lesen.
#KI-Agenten

✓ Verifiziert · 2 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

Zwanzig Versuche kosteten den besten Agenten ein Drittel der Punkte.
2026-10-06
Ein Modell lernte ohne das Verfahren, das jede KI trainiert.
2026-10-06
TikTok steckt einen Einkaufsbot in das Video, das Sie ansehen.
2026-10-06
Wikimedia verdächtigt OpenAI-Agenten für die Störung im Mai.
2026-10-06
Metas Assistent führt eine Stundenakte über alle Ihre Bekannten.
2026-10-05