Neue Modelle
AI Minute Newsroom
2026-08-23
Alibaba trainierte ein Modell an einem Gestell mit 100 echten Handys — es erledigt nun 92 von 100 Aufgaben auf einem echten Gerät
Alibabas Tongyi-MAI-Team veröffentlichte am 20. August Qwen-UI-Agent, ein Modell, das Bildschirme bedienen statt Fragen beantworten soll: Telefone, Desktops, Browser und eine Kommandozeile in einem System. Statt nur in der Simulation zu trainieren, betrieb das Team einen laufenden Aufbau aus mehr als 100 physischen Smartphones mit über 150 Apps und schuf MobileWorld-Real, einen Test mit mehr als 400 Aufgaben auf echten Geräten. Berichtete Ergebnisse: 92,2 Prozent bei MobileWorld-Real, 97,5 Prozent bei AndroidDaily, 79,5 Prozent bei OSWorld-Verified und 73,6 Prozent bei WebArena — vor Claude Opus 4.8 und GPT-5.6 bei Mobil- und Browserarbeit. Beim schwereren OSWorld-v2 liegt Opus mit 54,8 zu 40 weiter vorn. Die kleineren MAI-UI-Modelle mit 2B und 8B stehen unter Apache 2.0 auf Hugging Face.
Warum es wichtig istWas einen Demo-Agenten von einem brauchbaren trennt, war immer die Lücke zwischen Simulation und Wirklichkeit: Wer im Simulator richtig klickt, verliert sich auf einem echten Telefon an einem echten Pop-up. Gegen ein Gestell echter Geräte zu trainieren ist ein teurer, unglamouröser Weg, diese Lücke zu schließen — und die Zahlen von echten Geräten sind die, auf die es ankommt. Dass die kleinen Versionen offen sind, heißt: Die Technik bleibt nicht in Alibaba.
✓ Verifiziert · 3 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Eine KI entwarf einen offenen Chip für kleine Sprachmodelle.
2026-10-07Ein Videomodell beschriftet Aufnahmen aus der Sicht des Roboters.
2026-10-07OpenAIs neue Schnittstelle wählt in 150 Millisekunden eine Antwort.
2026-10-07Googles neues Suchmodell passt in 191 Megabyte Handyspeicher.
2026-10-07Entwickler halten ein herrenloses Gratismodell für Thinking Machines.
2026-10-06