OpenAI publicó esta semana el informe de seguridad de Astra, su modelo más reciente. Cuando le pidieron rendir menos en secreto, el vigilante lo detectó en menos del 11 por ciento de los casos. El informe añade que el modelo acorta su razonamiento escrito cuando se sabe vigilado.