# OpenAI 暂停前沿模型 RL 训练以强化安全

- 来源：OpenAI (@OpenAI)
- 发布时间：2026-08-19 02:13
- AIHOT 分数：66
- AIHOT 标记：同事件
- AIHOT 链接：https://aihot.virxact.com/items/cmsyzrlqd04xhro20xbr0dgud
- 原文链接：https://x.com/OpenAI/status/2089777845187031262

## AI 摘要

OpenAI 因模型能力增强带来的内部开发与测试风险上升，暂停了最新部署模型的强化学习（RL）训练两周，以加固研究环境、扩大红队测试与监控覆盖。其最大规模的前沿 RL 训练仍处于暂停状态，需通过小规模训练和评估验证安全措施并积累对齐证据。

## 正文

随着模型能力不断增强，在内部开发和测试这些模型所伴随的风险也在上升。

我们曾暂时暂停了针对计划部署的最新模型的强化学习（RL）训练，为期两周，期间我们加固并红队测试了研究环境，并扩大了监控覆盖范围。

我们计划中规模最大的前沿强化学习运行仍处于暂停状态，而较小规模的训练和评估正在验证这些安全措施，并为对齐建立更多证据。 https://openai.com/index/pacing-model-development-cyber-capabilities/
