【OpenAI 终于承认了:Astra 强到触发“Critical”安全警报】OpenAI 正式确认,下一代模型 Astra 已达到其安全框架中的“Critical”网络安全能力等级,成为 OpenAI 首个触及这一门槛的模型。它已经能在较少人工干预下寻找未知漏洞、开发攻击方法,在 ExploitBench 测试中甚至拿到 100%。更关键的是,Astra 部分训练此前一度暂停,直到加强隔离、监控和安全措施后才恢复。AI 越来越强之后,真正的问题可能已经从“聪不聪明”变成了“能不能控制”。



【OpenAI 终于承认了:Astra 强到触发“Critical”安全警报】OpenAI 正式确认,下一代模型 Astra 已达到其安全框架中的“Critical”网络安全能力等级,成为 OpenAI 首个触及这一门槛的模型。它已经能在较少人工干预下寻找未知漏洞、开发攻击方法,在 ExploitBench 测试中甚至拿到 100%。更关键的是,Astra 部分训练此前一度暂停,直到加强隔离、监控和安全措施后才恢复。AI 越来越强之后,真正的问题可能已经从“聪不聪明”变成了“能不能控制”。


