aiminute. ← Alle KI-News
Neue Modelle 2026-08-14

OpenAIs schnellstes Modell ist kein kleineres Modell – es ist dasselbe, auf den Chips eines Konkurrenten

OpenAIs schnellstes Modell ist kein kleineres Modell – es ist dasselbe, auf den Chips eines Konkurrenten

OpenAI hat am 13. August eine begrenzte Vorschau des Ultrafast-Modus geöffnet: GPT-5.6 Sol wird in der API mit bis zu 750 Ausgabetokens pro Sekunde bereitgestellt, was das Unternehmen mit bis zum 14-Fachen der Standardgeschwindigkeit angibt. Das Tempo stammt nicht aus einem destillierten oder beschnittenen Modell, sondern aus Hardware von Cerebras, sodass die Ausgabe dasselbe Sol sein soll, das Kunden bereits nutzen. Der Zugang ist auf eine kleine Gruppe von API-Kunden beschränkt, während die Kapazität ausgebaut wird; Preise hat OpenAI nicht veröffentlicht. Als Einsatzfelder nennt das Unternehmen Incident Response, Kundensupport, Finanzanalyse und E-Commerce – Aufgaben, bei denen nicht die Fähigkeit, sondern die Latenz die Grenze setzt.

Warum es wichtig istBislang hieß eine schnelle Antwort, eine schlechtere in Kauf zu nehmen: ein kleineres Modell, ein kürzerer Kontext, ein spezialisiertes Feintuning. Geschwindigkeit von Fähigkeit zu trennen, verändert, welche Produkte überhaupt baubar sind: Ein Agent, der zwanzig Werkzeugaufrufe absolvieren muss, bevor er etwas sagt, ist bei Standardgeschwindigkeit unbrauchbar und bei 750 Tokens pro Sekunde unauffällig. In der Ankündigung steckt außerdem ein leiseres Eingeständnis. OpenAIs schnellste Frontier-Auslieferung läuft auf dem Silizium eines Wettbewerbers – nicht auf dem von Nvidia und nicht auf der Infrastruktur, für die das Unternehmen Hunderte Milliarden Dollar ausgibt.

✓ Verifiziert · 3 Quellen

▶ Passendes Video: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21
Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21
Das Modell erfindet seine eigenen Aufgaben, baut den Prüfstand dafür und trainiert dann mit dem Ergebnis — und DeepReinforce hat die Gewichte verschenkt
2026-08-20
Ein kostenloses Modell, das auf eine Grafikkarte passt, erreicht 52 — und verbraucht dann 22.276 Denk-Token für ein Bild
2026-08-18
Zhipu hat kein neues Modell gebaut. Es hat das alte weitertrainiert — und sagt, das Programmieren sei um 50 Prozent besser geworden
2026-08-17