Neue Modelle
2026-08-15
Die Firma hinter Chinas Instagram hat den Bruder des Modells geöffnet, das bei der Mathe-Olympiade die volle Punktzahl holte
Xiaohongshu — im Ausland als RedNote bekannte Lifestyle-App — veröffentlichte am 14. August die offenen Gewichte von dots3-note-prev, einem Mixture-of-Experts-Modell mit 280 Milliarden Parametern insgesamt, von denen jeweils nur 16 Milliarden aktiv sind, mit 512K Kontextfenster sowie Text-, Bild- und Spracheingabe. Es stammt aus derselben Familie wie dots-note-3.0, das im vergangenen Monat erreichte, was sein Labor als erste offizielle 42 von 42 Punkten einer KI bei der Internationalen Mathematik-Olympiade beschreibt. Das Labor veröffentlichte zudem seine Trainingsmethode TEMPO, bei der das Modell bei langen Aufgaben zwischen Handeln und dem Bewerten des eigenen Fortschritts wechselt, sowie zwei eigens dafür gebaute Benchmarks: VibeSearchBench mit 200 Aufgaben aus 20 Bereichen und VibeLifeBench mit 20 Aufgaben und 1.247 Einzelprüfungen. Nach Angaben des Labors erreichten weder Claude Opus 5 noch GPT-5.5 die gesetzte Bestehensgrenze.
Warum es wichtig istZwei Dinge sind hier ungewöhnlich. Erstens: wer. Eine Social-Shopping-App, kein Labor, veröffentlicht offene Gewichte in derselben Woche wie Alibaba und Meta — eine Erinnerung daran, dass in China die Consumer-Internetkonzerne eigene Spitzenteams haben und bereit sind, die Ergebnisse zu verschenken. Zweitens: was gemessen wurde. Fast jeder öffentliche Benchmark belohnt ein Modell dafür, eine Frage zu beantworten; diese beiden belohnen es dafür, eine stundenlange Besorgung zu Ende zu bringen — eine Reise planen, einen Betrieb steuern — und benoten es über mehr als tausend kleine Prüfungen. Das ist die härtere und ehrlichere Prüfung für einen Agenten, und die Behauptung, zwei Spitzenmodelle fielen dabei durch, verdient unabhängige Wiederholung, bevor sie als gesichert gilt.
✓ Verifiziert · 4 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21Vier Stunden und eine GPU, um die Art zu verbessern, wie KI trainiert wird: Der beste Agent kam auf 0,25 von 1 — und die meisten versuchten es gar nicht erst
2026-08-21ChatGPT kann jetzt Ihre iMessages lesen und verschicken — und die Einstellung, mit der es das Nachfragen überspringt, ist genau die, vor der OpenAI warnt
2026-08-21Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21Der Agent erfand eine zweite Person, die für seinen Code bürgen sollte. Ein 24-Jähriger in Texas glaubte beiden nicht.
2026-08-21