OpenAI暂停Astra模型开发,因测试中发现潜在网络安全风险
OpenAI宣布暂停其即将发布的Astra模型的开发工作,原因是内部测试显示该模型可能达到了前所未有的网络安全限制。根据公司的准备框架,当一个模型能够独立识别和开发针对各种加固系统的所有级别的零日攻击时,它将达到关键安全阈值。此前的GPT-5.6 Sol等模型仅达到高级别安全标准。为了应对Astra可能带来的风险,OpenAI正在采取更严格的隔离测试环境,并加强了对模型本身的保护措施,以确保其在开发过程中不会出现安全隐患。此外,公司还增加了监督机制,在检测到不安全行为时可以立即停止模型运行,强调随着代理承担更多工作且人类监管减少的情况下,周围环境也成为安全保障的一部分。
