Greg Brockman · @gdb · X·2026-08-19 02:36·37分钟前
AI 导读

OpenAI 暂时放缓前沿模型训练,包括最大规模的前沿 RL 训练,以加强安全与监控。公司已暂停最新部署模型的 RL 训练两周,用于加固研究环境、红队测试并扩大监控覆盖。最大规模前沿 RL 运行仍处于暂停状态,待小规模训练和评估验证安全措施及对齐证据。

Greg Brockman@gdb
同事件
72AI 编辑部评分,满分 100
2026-08-19 02:36· 37分钟前
AI 导读

OpenAI 暂时放缓前沿模型训练,包括最大规模的前沿 RL 训练,以加强安全与监控。公司已暂停最新部署模型的 RL 训练两周,用于加固研究环境、红队测试并扩大监控覆盖。最大规模前沿 RL 运行仍处于暂停状态,待小规模训练和评估验证安全措施及对齐证据。

正文 · AI 翻译

我们暂时放缓了前沿模型的训练规模,包括我们计划中规模最大的前沿强化学习,以加强安全与监控。我们相信,对安全性的信心将日益成为决定 AI 发展节奏的关键因素。

OpenAI随着模型能力不断增强,我们在内部开发和测试这些模型所伴随的风险也在上升。 我们曾暂时暂停了针对计划部署的最新模型的强化学习(RL)训练,为期两周,期间我们加固并红队测试了研究环境,同时扩大了监控覆盖范围。 我们规模最大的前沿强化学习训练计划仍处于暂停状态,而较小规模的训练和评估正在验证这些安全防护措施,并为对齐建立更多...