# OpenAI：因网络安全风险，延缓 Astra 模型发布

- 来源：IT之家（RSS）
- 发布时间：2026-08-08 07:08
- AIHOT 分数：78
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmsjk6eiz0byoroo5cc4bcwg6
- 原文链接：https://www.ithome.com/0/987/221.htm

## 精选理由

将模型定级为关键网络风险并延缓发布，呈现了准备框架在高能力模型上的实际触发与管控流程，为其他前沿模型的发布治理提供了可对照的实例。

## AI 摘要

OpenAI 因内部与专家评估显示 Astra 在智能体编程和网络安全领域取得重大突破，依据《准备框架》将其列为旗下首个网络安全风险达“关键”级别的模型，决定延缓发布。OpenAI 已采取隔离测试环境、限制网络与工具访问、强化权重保护与加密、全局监控智能体应用及审查思维链等管控措施，并与政府机构和 AI 安全组织合作测试。CEO 萨姆·奥尔特曼表示 Astra 性能强劲，正全力推进公开发布。

## 正文

IT之家 8 月 8 日消息，OpenAI 表示，内部与专家评估显示，即将发布的模型 Astra 在智能体编程和网络安全领域取得重大突破。根据其《准备框架》（Preparedness Framework），Astra 已被列为 OpenAI 旗下首个在网络安全领域达到“关键”（Critical）风险级别的模型。

IT之家注：根据该框架，AI 模型满足以下任一条件即触及“关键”门槛：

无干预挖掘零日漏洞：无需人类干预，即可在多个经过安全加固的真实关键系统中，识别并开发出涵盖各严重等级的有效零日漏洞利用程序。

自主发起端到端攻击：仅需提供高层级战略目标，即可针对加固目标自主构想并实施全新的端到端网络攻击。

OpenAI 特别强调，Astra 是一款尚未发布的模型，并未参与此前针对 Hugging Face 的网络攻击事件。

为确保后续开发安全合规，OpenAI 宣布已采取多项管控措施：

对高能力模型及相关研发活动实施更严格的安全控制，包括设置隔离测试环境、限制网络与工具访问权限、强化模型权重保护与加密、部署额外的监控与检测能力，以及实施沙箱化运行；并暂停内部所有尚未满足上述强化安全标准的 Astra 相关活动。

对 Astra 的所有智能体应用（包括训练和评估阶段）实施了涵盖高风险行为与对齐失效的全局监控。通过评估模型思维链（CoT）审查并拦截高风险操作。

与相关政府机构以及指定的 AI 安全组织合作，共同测试该模型；向第三方测试合作伙伴提供推荐的安全控制规范，以确保更高风险的评估与工作负载能够在安全状态下运行。

OpenAI 首席执行官萨姆 · 奥尔特曼（Sam Altman）随后表示，Astra 是一款性能强劲的模型，我们正在全力推进它的公开发布。

我们始终认为，把顶尖模型局限在少数人手里并不是个好策略。

不过鉴于它在网络安全方面的强大能力，我们还需要一点时间来确保万无一失。希望大家不用等太久！
