aiminute. ← Alle KI-News
Gerüchte AI Minute Newsroom 2026-08-21

Gerücht: Das anonyme Gratismodell soll weiterhin von Zhipu stammen — doch der Wert, der es berühmt machte, umfasste zehn Aufgaben, und der volle Durchlauf ist Mittelmaß

Gerücht: Das anonyme Gratismodell soll weiterhin von Zhipu stammen — doch der Wert, der es berühmt machte, umfasste zehn Aufgaben, und der volle Durchlauf ist Mittelmaß

Dies ist ein unbestätigtes Gerücht und wird als solches veröffentlicht. Ein Modell namens Ox Alpha erschien am 20. August auf OpenRouter unter einem anonymen Anbieter, der nur als „Stealth“ gekennzeichnet ist: eine Woche kostenlos, mit einem Kontextfenster von 1.048.576 Token, bis zu 131.072 Token Ausgabe sowie Text-, Bild- und Videoeingabe. Am 21. August veröffentlichte der Forscher Ben Davis eine Fingerabdruckanalyse und erklärte, er sei „zu 99 % sicher“, dass es sich um ein unveröffentlichtes Mitglied von Zhipus GLM-5-Familie handele: Tokenverbrauch des Video-Encoders identisch mit GLM-5V-Turbo, ein Tokenizer, der bis auf einen festen 75-Token-Rahmen mit GLM-5.3 übereinstimmt, dasselbe Verweigerungsverhalten bei Audioeingabe, derselbe Fehlercode „1301“ und eine vergleichbare Emoji-Rate in der Ausgabe. Die Analyse schließe Xiaomi MiMo, DeepSeek, Google, Qwen, xAI, OpenAI und Anthropic aus. Bestätigt ist nichts davon: Bis zum 23. August hat kein Unternehmen Ox Alpha für sich reklamiert, und Zhipu schweigt. Beachten Sie auch die Datenfrage. OpenRouters eigene Modellseite besagt, dass an Ox Alpha gesendete Eingaben und Antworten vom anonymen Anbieter gespeichert, aber nicht zum Training verwendet werden — während OpenCode dasselbe Modell mit „keine Datenspeicherung“ bewarb. Solange der Anbieter nicht benannt ist, lautet die sichere Annahme: Was Sie senden, behält ein Unternehmen, das Ihnen seinen Namen nicht genannt hat. (Korrektur, 23. August: In unserer ursprünglichen Meldung hieß es, Ox Alpha habe im Coding-Benchmark DeepSWE 80 % pass@1 erreicht, vor Claude Fable 5 mit 65 %, GLM-5.3 mit 62 % und GPT-5.6-sol mit 52 %. Dieser Wert stammte aus einer Teilmenge von 10 Aufgaben — weniger als 9 % des Benchmarks. Davis hat seither den vollen Satz von 113 Aufgaben durchlaufen lassen und rund 63 % erhalten, also auf Höhe von GPT-5.6 Sol statt vor dem Feld; er selbst sagt, der Wert des vollen Satzes sei der sinnvolle. Ox Alpha hat den Benchmark nicht angeführt. Unsere Überschrift behauptete das, und das war falsch.)

Warum es wichtig istDie Korrektur ist die Nachricht. Ein Ergebnis aus zehn Aufgaben ging in zwei Tagen als „anonymes Modell führt Coding-Benchmark an“ um die Welt; das widersprechende Ergebnis aus 113 Aufgaben wird bei Weitem nicht so weit reisen. Wann immer ein Modell das Feld deutlich hinter sich lässt, lautet die erste Frage, wie viele Aufgaben es tatsächlich bekommen hat — kleine Stichproben erzeugen große, aufregende, bedeutungslose Abstände. Der Rest gilt weiterhin: Die Identität ist unbewiesen, und ein starkes Modell anonym und eine Woche kostenlos anzubieten, ist ein Vertriebskanal, kein Geschenk. Der Benchmark sind Sie — und hier sagt der Anbieter, dass er behält, was Sie senden.
#Coding

⚠ Unbestätigtes Gerücht — Vorsicht

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

OpenAI verspricht täglich eine Neuerung oder setzt Limits zurück.
2026-10-05
Eine Flut von KI-Berichten hat Googles Bug-Prämien gestoppt.
2026-10-04
Anthropic zahlt für die Ausbildung von 10.000 Claude-Ingenieuren.
2026-10-04
Ein Linux-Desktop weist von KI geschriebenen Code komplett ab.
2026-10-04
DeepSeek öffnet den Code seines neuen Schreibtisch-Agenten.
2026-10-03