STORY · 事件进行中

OpenAI 在 RLSlow 项目中确认推理模型可扩展训练

1 个精选信源 · 1 篇报道持续 1最新动态 1天前
最新进展

OpenAI 长文阐述对齐与监测困境,称 CoT 监控能力正在减弱

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. OpenAI 长文阐述对齐与监测困境,称 CoT 监控能力正在减弱
    OpenAI:官网动态(RSS · 排除企业/客户案例)官方一手精选

    OpenAI 发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱,GPT‑6 Astra 在对齐上显著优于 GPT‑5.6 Sol;作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。