聚焦领域:Anthropic研究所的核心研究方向

Anthropic:Research(发表成果 · 网页)·2026-05-07 18:29·114天前
AI 导读

Anthropic研究所公布了其四大核心研究领域:经济扩散、威胁与韧性、真实世界中的AI系统以及AI驱动的研发。该机构将利用其身处前沿AI实验室内部的独特优势,研究AI对世界的实际影响,并公开分享成果。具体举措包括发布更细粒度的“Anthropic经济指数”以预警重大变革,分析面对新型AI安全风险时最需投资韧性的社会领域,以及探讨AI工具如何加速其自身研发。这些研究成果将为Anthropic的“长期利益信托”提供决策依据,并帮助外部组织与公众更好地应对AI发展。

Anthropic:Research(发表成果 · 网页)
精选
67AI 编辑部评分,满分 100

聚焦领域:Anthropic研究所的核心研究方向

2026-05-07 18:29· 114天前
AI 导读

Anthropic研究所公布了其四大核心研究领域:经济扩散、威胁与韧性、真实世界中的AI系统以及AI驱动的研发。该机构将利用其身处前沿AI实验室内部的独特优势,研究AI对世界的实际影响,并公开分享成果。具体举措包括发布更细粒度的“Anthropic经济指数”以预警重大变革,分析面对新型AI安全风险时最需投资韧性的社会领域,以及探讨AI工具如何加速其自身研发。这些研究成果将为Anthropic的“长期利益信托”提供决策依据,并帮助外部组织与公众更好地应对AI发展。

推荐理由

Anthropic 的研究所首次系统公开研究议程,这不是公关辞令,而是一份真问题清单,尤其 AI 驱动的 AI R&D 部分,预示了递归自我改进的可能路径,值得反复读。

正文 · AI 翻译
Focus areas for The Anthropic Institute

在人类学研究所(TAI),我们将利用从前沿实验室内部获取的信息,研究人工智能对世界的影响,并与公众分享我们的发现。在此,我们公开了驱动我们研究议程的核心问题。

我们的议程聚焦于四个研究领域:

  • 经济扩散
  • 威胁与韧性
  • 现实世界中的AI系统
  • AI驱动的研发

在《AI安全核心观点》中,我们曾指出,开展有效的安全研究需要与前沿AI系统保持密切接触。同样的逻辑也适用于研究AI对安全、经济和社会的影响。

在Anthropic,我们看到了早期证据,表明软件工程等工作正在发生根本性变化。我们观察到Anthropic内部经济开始转型,我们构建的系统带来了新型威胁,并且出现了AI加速自身研发进程的早期迹象。为了充分实现AI进步的益处,我们希望尽可能多地分享这些信息。我们正在研究这些动态将如何塑造外部世界,以及公众如何帮助引导这些变革。

在TAI,我们将以前沿实验室内部人员的视角,研究AI在现实世界中的影响,然后发布这些研究成果,以帮助外部组织、政府和公众就AI发展做出更明智的决策。

我们将分享研究、数据和工具,使个人研究者和机构能够更便捷地研究这些问题。具体而言,我们将分享:

  • 来自《Anthropic经济指数》的更细粒度信息,并以更高频率发布,内容涉及我们观察到的AI对劳动力市场的影响和使用情况。我们将努力成为重大变革与颠覆的早期预警信号。
  • 关于哪些社会领域最需要针对新型AI安全风险进行韧性投资的研究。
  • 关于Anthropic内部工作因新AI工具而加速的更多详细信息,以及关于AI系统潜在递归自我改进所带来影响的思考。

TAI 将影响 Anthropic 做出的决策。这可能表现为公司向世界分享原本不会公开的数据(如经济指数),或以不同方式发布技术(例如网络威胁分析,这些分析会输入到 Project Glasswing 等项目中)。

我们预计,由 The Anthropic Institute 开发的工作将日益成为 Anthropic 长期利益信托(LTBT)的重要输入。LTBT 的使命是确保 Anthropic 持续优化其行动,以造福人类的长期利益。我们与 LTBT 以及 Anthropic 各部门的员工共同制定了这份研究议程。

这是一份动态议程,而非固定不变的。我们将随着证据的积累不断微调这些问题,并预计未来会出现当前未涵盖的新问题。我们欢迎就这份议程提供反馈,并将根据我们在对话中学到的内容对其进行修订。

如果您有兴趣帮助我们回答其中一些问题,我们欢迎您申请成为 Anthropic 研究员。该研究员项目是一个为期四个月、有资助的机会,您可以在 TAI 团队成员的指导下解决其中一个或多个问题。您可以在此处了解更多信息并申请加入下一期。

我们的研究议程:

最后更新:2026 年 5 月 7 日

经济扩散

理解日益强大的 AI 系统的部署如何改变经济至关重要。我们还需要开发必要的经济数据和预测能力,以便选择以有益于公众的方式部署 AI。

为了回答我们研究这一支柱中的问题,我们将进一步开发 The Anthropic Economic Index 中的数据。我们还将探索其他方法,以完善我们对强大 AI 可能如何影响社会的模型,无论是通过导致失业、前所未有的经济增长,还是其他影响。

AI 的采用与扩散

  • 谁在采用人工智能?人工智能的开发集中在少数国家的少数公司手中,但其部署却是全球性的。是什么决定了一个国家、地区或城市能否获得人工智能?如果能够获得,它又如何从人工智能中获取经济价值?哪些政策和商业模式能够切实改变这种平衡?免费或开放权重的模型如何影响这一动态?
  • 企业中的采用:是什么因素促使企业在层面采用人工智能,其后果又是什么?人工智能如何改变一个企业或团队实现最高效率的规模?人工智能的使用在企业间的集中程度如何?人工智能采用集中度的变化如何转化为加价率和劳动份额?如果一个三人团队或公司现在能完成过去需要三百人才能完成的工作,那么产业组织会发生什么变化?或者,如果企业能够更容易地集中知识,并且大规模这样做有好处,我们是否会看到规模更大、业务范围更广的企业,并有更强的动机去系统性地监控员工?
  • 人工智能是一种通用技术吗?人工智能是否遵循以往“通用技术”的模式,即在利润率最高的商业应用中采用速度最快,而在社会回报超过私人回报的领域采用速度最慢?是否存在能够改变这些动态的政策或决策?

生产力与经济增长

  • 生产力增长:人工智能将对整个经济体的创新速度和生产力增长产生什么影响?
  • 分享收益:哪些预先或再分配机制能够有效地将人工智能开发和部署带来的收益更广泛地传播开来?
  • 市场中的交易成本:人工智能如何影响市场中的交换体系和交易成本?何时能够代表你进行谈判的智能体能够提高市场效率和公平结果?何时不能?

广泛的劳动力市场影响

  • AI 与就业:AI 将如何改变经济各领域中人们的工作和就业状况?随着 AI 自动化取代现有经济领域中的部分环节,可能会涌现出哪些新的任务和岗位?这些变化在不同地区和国家的表现会有何差异?我们的 Anthropic 经济指数调查将每月提供信号,展示人们如何看待 AI 对其工作的影响,以及他们对未来的预期。我们也在更新经济指数,以分享更高频、更细粒度的数据。
  • AI 的扩散能否被调节?各国央行通过政策利率和前瞻性指引等“调节旋钮”来缓和通胀。是否存在类似的调节旋钮,让 AI 公司(在行业层面,与政府合作)可以转动,从而按行业控制 AI 的扩散速度?转动这些旋钮是否会带来明确的公共利益?

就业与工作场所的未来

  • 劳动者对自身工作的看法:经济各领域的劳动者如何看待其职业正在发生的变化?他们对这些变化有多大影响力,“劳动者”的权力能否被保留或转变?
  • 职业人才梯队:许多职业依赖初级岗位(如律师助理、初级分析师、初级开发人员)来为未来的资深从业者提供培训。如果 AI 吸收了那些历史上用于建立专业知识的任务,人们最初要如何成为专家?这对一个领域内资深判断力的长期供给意味着什么?
  • 为未来而学:人们今天应该学习什么,才能在未来占据有利位置?未来的职业是什么?AI 如何改变学习和培养专业能力的含义?
  • 有偿工作的角色:如果 AI 大幅降低了有偿工作在人类生活中的中心地位,哪些条件能让人们将时间和精力重新分配到其他意义来源上?我们能从历史上或当代那些工作稀缺或非必需的人群中学到什么?社会如何应对这一转型?

威胁与韧性

AI 系统往往同时推动多种能力的进步,其中也包括双重用途能力。一个在生物学领域表现更出色的 AI 系统,在制造生物武器方面也会更强。在计算机编程方面性能优异的 AI 系统,在入侵计算机方面也会更擅长。如果我们能更好地理解 AI 系统可能加剧的威胁,社会就能更容易地适应这种变化后的威胁格局。

我们提出这些问题,是为了帮助建立合作伙伴关系,以提升世界在面对变革性 AI 时的韧性,并开发针对可能出现的全新威胁的早期预警系统。其中许多问题将推动我们前沿红队的研究议程。

评估风险与双重用途能力:

  • 双重用途技术:强大的 AI 本质上具有双重用途——改善健康与教育的同一套工具,也可能被用于监控与压制。我们能否构建可观测性工具,来了解这种情况是否正在发生以及如何发生?
  • 合理评估风险:有哪些有效的、市场驱动的方法,可以提升社会对 AI 系统预期威胁的韧性?我们能否开发新的风险定价方式,或技术工具及人类组织,以便在可预见的威胁(例如更强的 AI 网络攻击能力)到来之前提升韧性?
  • 攻防平衡:在网络和生物等领域,具备 AI 能力是否会从结构上有利于攻击方?当 AI 被应用于更传统的领域(例如更深地整合进指挥与控制系统)时,它是否也有利于攻击方?更广泛地说,AI 将如何改变人类冲突的性质?

建立风险缓解措施:

  • 危机情景规划:冷战期间,美国总统有一条直通克里姆林宫的热线,用于核危机事件。在涉及 AI 系统的危机情景中,需要什么样的地缘政治基础设施?这种基础设施可能不一定是国家与国家之间的,也可能是公司与国家之间,或公司与公司之间的。
  • 更快速的防御机制:AI 能力可能在数月内取得进展。而监管、保险和基础设施的响应则需数年时间。我们如何弥合这一差距?防御机制——如自动化补丁、AI 驱动的威胁检测或预先部署的响应能力——能否跟上 AI 驱动攻击的节奏和规模?还是说这种不对称性是结构性的?我们又该如何尽可能有效地部署这些防御机制?

用于监控的情报能力

  • AI 对监控的影响:AI 如何改变监控的运作方式?它会让监控变得更便宜,还是更有效,抑或两者兼得?

现实世界中的 AI 系统

人与组织与 AI 系统的互动将成为社会变革的主要来源。理解 AI 系统可能如何改变与之互动的人和机构,是我们社会影响团队的核心关注领域。为了研究这些变化,我们正在推进现有工具并构建新工具来开展研究,范围涵盖用于更好观测我们平台的软件,以及用于进行大规模定性调查的工具。

AI 对个人与社会的影响:

  • 群体认知:当人口中的很大一部分人向同样的少数几个模型寻求建议时,我们的认知会发生什么变化?我们能否找到方法来衡量因共同使用 AI 而导致的大规模信念、写作风格和问题解决方法的改变?
  • 批判性思维:随着 AI 系统能力越来越强、越来越受信任,我们如何检测并避免因日益依赖 AI 判断而导致的人类批判性思维能力退化?
  • 技术界面:技术的界面可以决定人们如何与之互动——电视让人成为被动的观看者,而计算机则让人更容易成为创造性的生产者。可以构建什么样的界面,让 AI 系统能够增强并促进人的自主性?
  • 管理人类-AI 系统:人类如何有效管理由人类和 AI 系统混合组成的团队?反过来,AI 系统又如何管理由人类、AI 或两者组合构成的团队?

识别人工智能的重大影响:

  • 行为影响:正如社交媒体导致人类行为发生变化一样,人工智能也可能塑造人类行为。哪些监测或测量手段能让研究人员了解这一动态?
  • 赋能研究:是否存在某种透明度机制和工具,能够使广泛人群(而不仅仅是前沿人工智能公司)轻松研究现实世界中的人工智能使用情况?

理解与治理人工智能模型:

  • 系统“价值观”:人工智能系统所表达的“价值观”是什么?这些价值观与系统的训练方式有何关联?更具体地说,我们如何衡量人工智能“宪法”对模型部署后行为的影响?我们将扩展此前在这些问题上的研究。
  • 治理自主智能体:现有法律、治理体系和问责机制中的哪些方面可以适用于自主人工智能智能体?例如,海事法中关于废弃船舶的规定,与法律应如何处理无人监管运行的智能体具有相关性。反之,现有法律中是否存在已经适用于人工智能智能体、但本不应适用的方面?
  • 智能体的可靠性:自主人工智能智能体的哪些方面可以调整以适配现有法律、治理体系和问责机制?例如,我们能否确保人工智能智能体即使在缺乏直接人类控制的情况下,也能可靠地输出其唯一身份标识?
  • 以人工智能治理人工智能:我们能在多大程度上有效利用人工智能来治理人工智能系统?在人工智能监管的哪些领域中,人类要么具有比较优势,要么在法律或规范上要求必须“参与其中”?
  • 智能体交互:人工智能智能体在相互交互时会涌现出哪些类型的规范?不同的智能体可能如何表达不同的偏好,这些偏好又如何影响其他智能体?

人工智能驱动的研发

随着 AI 系统能力不断增强,科学家们正利用它们来开展更多研究工作。这意味着越来越多的科学研究正在自主或半自主地进行,人类主动监督的力度越来越小。在 AI 研究本身,日益强大的系统可能被用来帮助开发其自身的后续版本。我们有时将这种现象称为“AI 驱动的 AI 研发”。

AI 驱动的 AI 研发可能是制造更智能、更强大系统的“自然红利”。正如编码能力的进步催生了具有双重用途的网络能力,科学能力的进步可能催生具有双重用途的生物能力,复杂技术工作的进步自然也可能产生能够开发 AI 系统的 AI 系统。

AI 驱动的 AI 研发本身蕴含着巨大的潜在危险。当政策制定者评估他们可以动用的杠杆时,理解 AI 进步的速度如何变化,以及 AI 研究是否可能开始出现复合回报,将至关重要。

AI 用于 AI 研发

  • AI 研发的治理:如果 AI 系统被用于自主开发和改进自身,人类如何对这些系统行使有意义的可见性和控制权?最终将由什么来治理这些系统?
  • 消防演习场景:我们如何为“智能爆炸”进行“消防演习”?什么样的桌面推演才能真正测试实验室领导层、董事会和政府的决策能力?
  • AI 研发的遥测:我们如何衡量 AI 研究和开发的总体速度?为了收集这些信息,必须存在哪些类型的遥测技术和底层技术能力?与 AI 研发相关的指标如何作为递归自我改进的早期预警信号?
  • 控制 AI 加速:如果智能爆炸降临,哪些干预点有助于减缓或以其他方式改变爆炸的速度?假设人类能够干预,哪些实体应该拥有这种能力——政府?公司?

广义上的 AI 用于研发——即 AI 驱动其他领域的研究:

  • 技术树:人工智能正在加速某些科学领域的发展,其速度远超其他领域,这取决于数据的可用性、评估信号,以及知识中有多少是隐性知识或受机构壁垒限制。这种梯度差异有多大?科学进步构成的不断变化,对于哪些人类问题会首先得到解决,又意味着什么?
  • 锯齿状前沿:模型能力在某些领域比其他领域更强。那些具有巨大正外部性的领域——比如药物发现和材料科学——所获得的投资与其价值不相称。市场根据私人回报来引导模型改进的方向,但我们能否提升模型的表现,以应对社会外部性问题?

加拿大如何使用 Claude:来自 Anthropic 经济指数的发现

Claude 在不同模型和语言中的价值观

来源:Anthropic:Research(发表成果 · 网页)· anthropic.com