aiminute. ← Alle KI-News
Werkzeuge AI Minute Newsroom 2026-09-30

Ein täglicher Test prüft, ob Opus 5.5 heimlich schlechter wurde.

Ein täglicher Test prüft, ob Opus 5.5 heimlich schlechter wurde.

Ein Entwickler startete LiveNerf am 24. September und prüft Claude Opus 5.5 an den Werten der Startwoche. Ein älteres Modell läuft als Kontrolle mit, und erst über drei Punkte gilt ein Unterschied. Sechs von dreißig Tagen sind erfasst, das erste ehrliche Urteil kommt nicht vor Tag vierundzwanzig.

Warum es wichtig istAlle sagen, ihre KI sei nach dem Start schlechter geworden, doch niemand bewahrte einen sauberen Startwert. Nun gibt es ihn, also kann der nächste Streit mit Zahlen statt Eindrücken laufen.
#Coding

✓ Verifiziert · 1 Quellen

WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

OpenAIs neues Modell kommt dem besten für ein Fünftel nahe.
2026-09-30
OpenAIs neuer Daueragent bringt seinen eigenen Rechner mit.
2026-09-30
Ein daheim trainiertes Modell zieht mit einem Bezahldienst gleich.
2026-09-29
Metas Agent verkaufte die Tastatur billig und gab die Adresse.
2026-09-29
Microsoft setzte 1.024 Agenten ohne Chef auf eine Aufgabe an.
2026-09-29