正文 · AI 翻译
我们暂时放缓了前沿模型的训练规模,包括我们计划中规模最大的前沿强化学习,以加强安全与监控。我们相信,对安全性的信心将日益成为决定 AI 发展节奏的关键因素。
随着模型能力不断增强,我们在内部开发和测试这些模型所伴随的风险也在上升。 我们曾暂时暂停了针对计划部署的最新模型的强化学习(RL)训练,为期两周,期间我们加固并红队测试了研究环境,同时扩大了监控覆盖范围。 我们规模最大的前沿强化学习训练计划仍处于暂停状态,而较小规模的训练和评估正在验证这些安全防护措施,并为对齐建立更多...