Guidelight AI Standards于8月22日发布评估报告,考察Anthropic、谷歌、OpenAI、Meta和xAI在公开文件中就控制自家系统写下了什么,依据的是截至8月18日可获取的材料。报告对六项做法按0到5分评分:记录和监测模型在内部的行为、在违规行为被大量标记后叫停系统、允许独立第三方审计控制措施并公布结果,以及是否真有一套遏制失控模型的方案。没有一家公司在任何单项上超过3分,多数评分为2分或更低。OpenAI以3分居首,Anthropic和Meta垫底。Guidelight首席科学家Steven Adler表示,这些公司对如何应对极其严重的事故说得如此之少,令他意外。