# Anthropic 论文发现 Claude 内部存在类似人脑的"全局工作空间"结构

- 来源：IT之家（RSS）
- 发布时间：2026-07-07 14:41
- AIHOT 分数：57
- AIHOT 链接：https://aihot.virxact.com/items/cmrabcx5d00xoihl3vfp05t7c
- 原文链接：https://www.ithome.com/0/973/522.htm

## AI 摘要

Anthropic 最新论文《大语言模型中的全局工作空间》在 Claude 模型中发现类似神经科学“全局工作空间理论”的结构，命名为 J-space。借助数学分析工具 J-lens，研究者观察到四项证据：Claude 可通过 J-space 集中关注特定概念、有意将“公平”等概念拖入并持久化、在国际象棋等复杂任务中 J-space 充当草稿本且其内容改变影响输出、进入 J-space 的概念可被模型其他部分共享利用。该结构非预设，是训练中自行出现，Anthropic 借“趋同演化”描述人脑与 AI 因效率需求独立演化出类似结构。

## 正文

IT之家 7 月 7 日消息，Anthropic 今天（7 月 7 日）在 X 平台发布推文，称最新研究表明 Claude 模型拥有“灵魂”，且相关证据表明 AI 和人脑之间存在“趋同进化”（Convergent Evolution）。

该论文主题为《大语言模型中的全局工作空间》，在 Claude 模型中发现类似神经科学中的“全局工作空间理论”（global workspace theory）的结构，并命名为 J-space。

IT之家注：在神经科学领域中，全局工作空间理论认为大量脑内活动处于后台自动运行状态，只有进入可被广泛共享的“工作空间”的信息，才会成为可描述、可保持、可推理的内容。该理论常用于解释注意、意识访问和复杂推理中的信息整合过程。

在最新论文中，Anthropic 认为 Claude 模型内部也存在相应结构，信息进入一个可向全脑广播的特权空间后，才会变得可被有意识访问，官方将其命名为 J-space。

在论文中，Anthropic 还介绍了名为 J-lens（全称 Jacobian Lens）工具，这是一种数学分析方法，用于弱化模型后台任务的干扰，并聚焦 Claude 在特定时刻关注的概念。

为验证 J-space 的存在，Anthropic 列出了 4 项观察结果：

在任意给定时间内，询问 Claude 正在思考什么，然后使用 J-lens 查看当时其 J-space 中存在哪些“概念”。

要求 Claude 牢记公平，然后观察它有意地将公平的概念拖到 J-space，以及是否能持久化。

在解决像国际象棋这样复杂的问题时，J-space 就像一个草稿本，当研究人员改变其内容时，克劳德的最终输出也会随之改变。

当一个概念被拖入 J-space 后，Claude 的任何其他部分，即使正在做完全不同的事情，仍然能够看到该概念，然后在自己的任务中利用它。

Anthropic 在论文中表示，这种结构并非 Claude 架构中预先设计的组成部分，而是在训练过程中自行出现，“推测原因是这种方式有助于组织计算”。

官方还借用“趋同演化”概念说明这一现象，该概念原本属于生物学概念，指不同物种在相似环境压力下，独立演化出相似特征。

本文中，Anthropic 借用该概念描述人脑与 AI 模型可能因处理复杂信息的效率需求，而出现功能上相似的结构设计。
