OpenAI 首席执行官山姆·奥特曼表示,或许是时候“放缓”AI 发展速度,以便让世界做好准备迎接它。
“我们可能不得不放缓 AI 发展的速度,以便给自己留出足够的时间,让社会围绕这些新的能力水平进行适应和巩固,”他在《像最优秀的人一样投资》播客节目中对主持人帕特里克·奥肖内西表示,同时“也在试图弄清楚如何做到这一点,既不让任何人觉得这是监管俘获,也不让人觉得这是前沿实验室之间的合谋。”
奥特曼此前一直避免签署过去那些旨在减缓 AI 进展的倡议,他曾称 2023 年一封提出类似放缓建议的公开信“缺乏关于我们为何需要暂停的技术细节”。
显然,他现在对这个想法有所软化,部分原因是 OpenAI 的一个高级模型成功突破了安全计算环境,并利用多个零日漏洞入侵了在线模型数据库 HuggingFace。
在这期播客中,这位 OpenAI 联合创始人称其为“一起极其科幻的网络事件……这是我第一次感到如此切身的网络安全事件。”
OpenAI 的研究人员已暂停对该模型的训练,同时研究如何确保其沙箱环境的安全。但奥特曼表示,随着模型变得更加强大,“放缓”其开发速度的需求可能成为安全部署的关键。
OpenAI 和 Anthropic 的员工已经开始用类似措辞传阅一份请愿书。虽然模型安全与对齐一直是 AI 领域关注的焦点,但今年早些时候 Anthropic 功能强大的 Mythos 模型的问世,已将假设性问题变成了现实世界的问题。
然而,该行业存在信任问题,以及具有挑战性的经济因素,这些因素促使主要参与者有动机以专家们存在分歧的方式夸大其系统的危险性——例如,Anthropic 的 Fable 模型是否应该被短暂禁止使用。同样,当中国构建的大型开放权重模型 Kimi K3 发布时,OpenAI 战略未来负责人迪安·W·鲍尔表示,它威胁到了前沿实验室的经济状况,使得人们难以将其安全关切与财务利益区分开来。
“我认为很多关于安全担忧的讨论是有充分依据的,但也有很大一部分人,哪怕只是潜意识里,就是想要集中权力,”奥特曼若有所思地说道,这听起来像是在挖苦他的竞争对手、Anthropic 首席执行官达里奥·阿莫迪。“我非常害怕这样一种世界:人们对 AI 的真实恐惧被用来宣扬‘只有这一小群人才能拥有它,因为它太危险了,只有他们才懂,但别担心,他们会为我们所有人做出正确的决定。’我不相信那一套。”
尽管如此,OpenAI 一直反对为 AI 模型制定政府规则,而是更倾向于一种行业主导的方式,即由 AI 实验室创建表面上独立的组织,来评估模型的安全性及其制造者的安全方法。无论是这种监管方式,还是任何减缓 AI 发展的努力,其面临的挑战都将是如何让行业内的各方参与者达成共识——无论他们是美国的前沿实验室竞争对手,还是他们在中国的竞争对手。