Neue Modelle
AI Minute Newsroom
2026-08-14
OpenAIs schnellstes Modell ist kein kleineres Modell – es ist dasselbe, auf den Chips eines Konkurrenten
OpenAI hat am 13. August eine begrenzte Vorschau des Ultrafast-Modus geöffnet: GPT-5.6 Sol wird in der API mit bis zu 750 Ausgabetokens pro Sekunde bereitgestellt, was das Unternehmen mit bis zum 14-Fachen der Standardgeschwindigkeit angibt. Das Tempo stammt nicht aus einem destillierten oder beschnittenen Modell, sondern aus Hardware von Cerebras, sodass die Ausgabe dasselbe Sol sein soll, das Kunden bereits nutzen. Der Zugang ist auf eine kleine Gruppe von API-Kunden beschränkt, während die Kapazität ausgebaut wird; Preise hat OpenAI nicht veröffentlicht. Als Einsatzfelder nennt das Unternehmen Incident Response, Kundensupport, Finanzanalyse und E-Commerce – Aufgaben, bei denen nicht die Fähigkeit, sondern die Latenz die Grenze setzt.
Warum es wichtig istBislang hieß eine schnelle Antwort, eine schlechtere in Kauf zu nehmen: ein kleineres Modell, ein kürzerer Kontext, ein spezialisiertes Feintuning. Geschwindigkeit von Fähigkeit zu trennen, verändert, welche Produkte überhaupt baubar sind: Ein Agent, der zwanzig Werkzeugaufrufe absolvieren muss, bevor er etwas sagt, ist bei Standardgeschwindigkeit unbrauchbar und bei 750 Tokens pro Sekunde unauffällig. In der Ankündigung steckt außerdem ein leiseres Eingeständnis. OpenAIs schnellste Frontier-Auslieferung läuft auf dem Silizium eines Wettbewerbers – nicht auf dem von Nvidia und nicht auf der Infrastruktur, für die das Unternehmen Hunderte Milliarden Dollar ausgibt.
✓ Verifiziert · 3 Quellen
▶ Passendes Video: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Reflection verschenkt ein Modell mit 501 Milliarden Parametern.
2026-10-06Microsofts neues Modell schreibt, bevor Sie fertig gesprochen haben.
2026-10-05Ein US-Labor verschenkt bald ein Modell auf Chinas Niveau.
2026-10-05Eine Videoseite verschenkt das beste offene Übersetzungsmodell.
2026-10-05Die Hälfte der Angerufenen hielt die KI für einen Menschen.
2026-10-04