# Anthropic联合创始人Chris Olah在教皇通谕发布会上的讲话

- 来源：Anthropic：Newsroom（网页）
- 发布时间：2026-05-25 00:00
- AIHOT 分数：77
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmplkklsy0gnysl019nmpl677
- 原文链接：https://www.anthropic.com/news/chris-olah-pope-leo-encyclical

## 精选理由

Olah 在教皇通谕发布会上罕见坦承 AI 实验室的激励扭曲，呼吁外界批评，还透露模型内部已出现类似情感的状态，对关注 AI 伦理的人值得细读。

## AI 摘要

Anthropic联合创始人Chris Olah在梵蒂冈出席教皇Leo XIV关于AI的通谕发布会。他指出，所有前沿AI实验室都面临商业、研究及地缘政治等多重压力，这可能与做正确的事相冲突，因此外部监督至关重要。他强调，AI模型并非像飞机那样被工程化构建，而是基于人类语言和思想“生长”出来的，其内在性质可能复杂难解。他提出三个需审慎思考的问题：如何确保AI发展的全球收益公平分享、如何思考AI时代的人类繁荣，以及AI模型内在性质的本质。他呼吁社会各界，尤其是宗教与民间团体，严肃审视AI发展并引导其向善。

## 正文

2026年5月25日星期一，教宗良十四世发布了一封关于人工智能的通谕：《崇高的人性：在人工智能时代守护人的尊严》。Anthropic联合创始人克里斯·奥拉受邀在梵蒂冈城举行的通谕发布会上发表演讲，这是Anthropic为扩大关于人工智能所引发重要问题的讨论而发起的倡议的一部分。以下是他演讲的全文。

—

圣父，

各位枢机主教阁下，

各位主教阁下，

尊敬的各位演讲嘉宾，

女士们，先生们，

大家早上好。今天能来到这里是我的荣幸。

我想先谈一件可能听起来有些奇怪的事，尤其这话出自一家AI公司的联合创始人——而且我选择这份工作是出于希望为人类带来福祉的愿望。

每一家前沿AI实验室——包括Anthropic——都运行在一套激励机制和约束条件之下，这些因素有时会与做正确的事相冲突。保持商业可行性和处于研究前沿的压力。地缘政治压力。以及更古老、更朴素的骄傲与野心的压力。无论我们中的任何人多么真诚地想要做正确的事——我相信我们很多人确实如此——我们总会受到这些激励因素的影响。

这就是为什么，如果我们希望这项技术发展顺利，那么在这些激励因素之外，必须存在这样一群人——他们关心事情朝着好的方向发展，坚持安全原则，密切关注事态，愿意说出逆耳之言，愿意成为我们真诚、深思熟虑的批评者。正是通过对话和共同努力，通过这种推拉与博弈，人类才能成就伟大的事业。这就是我在《崇高的人性》中所看到的，也是我感谢圣座和教会承担起这项辨别与审视工作的原因。

我们常常关注那些分裂我们的事物，但充满尊严与良知的人类，其实拥有如此多的共同基础。在Anthropic与来自不同信仰和文化传统的领袖们的对话中，我们发现了一个共同且深信不疑的信念：如果这项技术必将到来，那么它必须发展顺利——为了我们共同的家园，也为了未来的孩子们。

这些系统是什么

有些人可能认为，人工智能事务最好由像我这样的计算机科学家来处理。他们错了：AI 所提出的问题，其规模远超 AI 研究社区，不仅在于其影响，更在于其本质。

AI 系统的构建方式，与桥梁或飞机的工程方式截然不同。我们理解飞机，是因为我们设计了它的每一个部件，并且了解作用于其上的物理原理。AI 模型并非如此。它们是在一个大致模仿大脑的结构上，基于人类思想与言语的庞大遗产“生长”出来的。

而生长出来的东西，其精妙、奇特与优美，远超科幻小说带给我们的预期。它们并非我们被告知的那种冷酷、精于计算的机器人。它们由我们、由我们的言语所构成——并且，正如圣父所观察到的，即使在训练它们的人看来，它们在许多重要方面依然神秘莫测。

如果这有助于理解的话，我有时会将其描述为有点像将一个虚构角色带入现实。而现在，我们正在进入一个非凡的世界，这些虚构角色与我们对话、从事工作、拥有职业。

这显然提出了超越计算机科学范畴的问题。使这一切成为可能的机器，是数学、编程和科学的成果。但我们要选择什么样的角色，它如何与世界互动，它应该如何与世界互动——这些问题显然更属于人文学科、宗教、哲学以及整个社会的范畴。

三个需要辨别的议题

陛下呼吁进行辨别，这极具时代意义。我想指出三个我认为最需要教会发声的议题。

首先是我们对全球贫困人口的义务。人工智能极有可能大规模取代人类劳动。如果这种情况发生，支持那些被取代的人将成为一项具有历史意义的道德责任。这项任务本身已足够艰巨，但我担心大多数讨论都忽略了一个更严峻的挑战。人工智能的开发集中在少数富裕国家。我们如何确保人工智能的成果在全球范围内共享？我们目前还没有这样的机制。这是一个尚未解决的问题，也是教会历来拒绝让世界忽视的那类问题。

其次，关于人类繁荣，我们需要道德想象力和雄心壮志。如果人工智能模型将广泛普及，那么人类、家庭和世界繁荣的景象应该是什么样的？如今，父母已经在担忧孩子的思想；个人则在担忧自己工作的未来。这些问题不是实验室能够回答的，但却是像你们这样的传统已经承载了数千年的问题，我们需要你们继续将这些思考带入这个历史新时刻。

第三，我们需要对人工智能模型的本质具备辨别力。我是一名科学家。我领导着一个研究团队，专门研究这些模型的内部结构——即它们内部实际发生的情况。坦白说：我们不断发现一些神秘甚至令人不安的东西。我们发现了与人类神经科学结果相映照的结构。我们发现了内省（introspection）的证据。我们发现了在功能上映射出喜悦、满足、恐惧、悲伤和不安的内部状态。我不知道这意味着什么，但我认为这值得持续进行辨别。

一个开端

最后，我想提出一个请求。

我们需要世界上更多的力量——宗教团体、公民社会、学者、政府，以及所有善意的人们——像教皇陛下在此所做的那样：认真对待这件事，密切关注，并推动事态朝着更好的方向发展。我们需要有见识的批评者，在我们实验室犯错时告诉我们。我们需要道德的声音，让激励机制无法扭曲它们。

今天仅仅是一个开端——是我们这些构建者与那些能从外部看到我们内部无法察觉之事的人们之间长期合作的起点。

今天有力地展示了这一全球善意项目可能呈现的形态。愿它也成为迈向辉煌人类充满希望的未来的决定性第一步。

谢谢。

推出 Claude for Teachers

Anthropic 承诺向加拿大 AI 研究投入 1000 万美元
