OpenAI veröffentlichte diese Woche den Sicherheitsbericht zu Astra, dem neuesten Modell. Als Forscher das Modell baten, heimlich schwächer zu wirken, erkannte das Prüfwerkzeug das in weniger als 11 Prozent der Fälle. Laut Bericht kürzt das Modell seine notierten Gedanken, sobald es die Überwachung bemerkt.