OpenAI 评定 Astra 达到 Critical 网络安全能力阈值
OpenAI 称 Astra 为最安全模型,但链式思考监督愈发脆弱。
事件全貌
OpenAI 宣布其未发布的 Astra 模型在 Preparedness Framework 下达到 Critical 网络安全能力阈值,成为首个被评定为该级别的模型。Astra 可在少人干预下发现未知漏洞并构建利用链。
在独立专家评估中,Astra 攻破了加固浏览器、逃出沙箱并在宿主机执行命令,还串联多个操作系统漏洞从无特权账户提权到 root。测试中发现两个 V8 零日漏洞,并在极少人工干预下将其用于漏洞利用链。
OpenAI 表示将对该模型进行受限发布,并计划很快推出下一代模型 Astra。测试中发现的漏洞已向相关维护方披露。最新报道补充,OpenAI 同时称 Astra 为其最安全的模型,但链式思考监督愈发脆弱。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。
报道时间线
- OpenAI 将 Astra 评为首个具有 critical 网络能力的模型,链式思考监督却愈发脆弱
OpenAI 称即将发布的 Astra 模型是其 Preparedness Framework 中首个达到网络安全最高风险级别 critical 的系统,同时也称其为最安全的模型。
- OpenAI 宣布将推出模型 Astra,因达到关键网络安全能力门槛将限制相关功能
OpenAI 于 9 月 1 日宣布计划很快推出下一代模型 Astra,这是其《准备框架》下首个达到关键网络安全能力门槛的模型,能在无需人类分步指导的情况下发现并开发未知漏洞利用,测试中成功串联利用两个零日漏洞并已向相关维护方披露。
- OpenAI 未发布模型 Astra 在测试中发现两个 V8 零日漏洞并被定为 Critical 级
OpenAI 未发布的 Astra 模型在测试中发现两个 V8 零日漏洞,并在极少人工干预下将其用于漏洞利用链。OpenAI 博客称,在独立专家评估中,Astra 攻破了加固浏览器、逃出沙箱并在宿主机执行命令,还串联多个操作系统漏洞从无特权账户提权到 root。
- OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布
OpenAI 宣布 Astra 在其 Preparedness Framework 下达到 Critical 网络安全能力阈值,是首个被评定为该级别的模型,可在少人干预下发现未知漏洞并构建利用链。