8月10日,OpenAI宣布将放缓其新一代模型Astra的开发节奏。此前,公司对该模型进行了内部评估,结果显示"无法排除其具备关键性网络能力"——换言之,Astra可能拥有足以引发网络安全风险的强大能力。

为此,OpenAI决定在正式发布Astra之前,进一步扩大测试范围并强化安全防护措施。公司将依据2023年发布的"准备框架",在完善相应安全机制之前,暂缓推进该模型的开发进程。
此外,OpenAI特别澄清,Astra与此前发生的HuggingFace漏洞攻击事件无关。
值得关注的是,这很可能是人工智能前沿实验室首次因网络安全方面的担忧,主动承诺放慢自身模型的开发步伐,标志着AI安全治理进入了一个新阶段。


