OpenAI 发布 AI 模型 Astra
OpenAI 首席科学家发文呼吁建立强制性安全门槛,放慢 AI 发展速度。
事件全貌
OpenAI 于 2026 年 9 月 6 日发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目确认推理模型可扩展训练的起点,系统阐述目标对齐与价值对齐的区分。文章指出链式思维(CoT)监控的效果正随着模型能力提升而逐步减弱,GPT‑6 Astra 在对齐上显著优于 GPT‑5.6 Sol。作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。
次日,OpenAI 首席科学家 Jakub Pachocki 发表同一主题长篇博文,担心没有人准备好应对机器智能持续快速增长的后果,呼吁建立可由第三方审计、政府或国际组织执行的强制性安全门槛。
相关评述指出,对齐与监控尚未跟上 Agent 竞赛的步伐。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。
报道时间线
- OpenAI 首席科学家 Jakub Pachocki 发文《An Alien Mind》,博主评述对齐与监控尚未跟上Agent竞赛
OpenAI 首席科学家 Jakub Pachocki 发布长文《An Alien Mind》(https://openai.com/index/an-alien-mind/),谈 AI 现状、对未来几年的担忧以及需要做出的选择。
- OpenAI 首席科学家 Jakub Pachocki 发文呼吁放慢 AI 发展速度,警告智能体可能失控
OpenAI 首席科学家 Jakub Pachocki 发表长篇博文,担心没有人准备好应对机器智能持续快速增长的后果,呼吁建立可由第三方审计、政府或国际组织执行的强制性安全门槛。
- OpenAI 长文阐述对齐与监测困境,称 CoT 监控能力正在减弱
OpenAI 发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱,GPT‑6 Astra 在对齐上显著优于 GPT‑5.6 Sol;作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。
- OpenAI 首席科学家 Jakub Pachocki 发布长文《An Alien Mind》谈 AI 现状与未来几年的担忧
OpenAI 首席科学家 Jakub Pachocki 发布长文《An Alien Mind》,谈 AI 现状、他对未来几年的担忧,以及为让未来掌握在人类手中需要做出的选择。全文见 https://openai.com/index/an-alien-mind/