Guidelight AI Standards评估五家前沿AI实验室的AI失控遏制能力,发现少有企业公开完整应对方案。评估覆盖Anthropic、Google、OpenAI、Meta和xAI,考察监控、异常行为处置、第三方审计及失控模型关闭等机制。满分5分中OpenAI以3分居首,Anthropic和Meta最低。其“遏制方案”指一旦发生失控情形的应对措施。