没人设计它,却自己长了出来:Claude 内部惊现类人脑"全局工作空间"
J-space(全局工作空间)是 Anthropic 在 2026 年 7 月的研究《A Global Workspace in Language Models》中发现的一小组内部神经模式,它在 Claude 的内部激活中扮演着类似神经科学"全局工作空间"的角色——一个让信息变得可被"意识到"、可调用的共享心智通道。它的名字来自发现它所用的 Jacobian(雅可比)技术。关键在于,J-space 不是模型对外可见的思维链(chain-of-thought)输出,而是安静运行在内部激活里的表示——Claude 可以"想"一个概念却不把它写出来。研究发现,J-space 具备可报告、可自主控制、参与因果推理等五个功能特性,且它并非人为设计,而是在训练中自发涌现。本文基于 Anthropic 官方研究,解读 J-space 是什么、如何被发现、有哪些特性,以及它对理解大模型认知的意义。

J-space 是什么:大模型里的"共享心智通道"
J-space 是 Anthropic 在 Claude 内部发现的一小组神经激活模式,其功能类似神经科学中的"全局工作空间"——信息进入这个空间后,才变得可被模型访问、调用和"意识到"。这里的"意识"指的是功能意义上的可访问性,而非主观体验。
它最重要的一个特征是:J-space 不等于思维链。
● 思维链(chain-of-thought):是模型写出来的、对外可见的推理文字
● J-space:运行在内部激活里,是"没写出来的想法"——Claude 可以在 J-space 里"想"一个概念,却不在输出中体现
换句话说,J-space 更接近模型"心里在想什么",而不是"它说了什么"。
如何发现 J-space:Jacobian Lens 技术
J-space 是通过一种叫 Jacobian Lens(J-lens,雅可比透镜)的技术发现的,它能把模型"心里正在想的概念"读出来。J-space 这个名字正是来自这项技术。
其原理可以这样理解:
● 对 Claude 词表里的每一个词,J-lens 找出那个会提高该词在未来输出中出现概率的内部激活模式
● 把这套方法应用到各个处理层,就能得到一份可读、且随推理不断演变的清单——显示哪些概念正"在模型的脑子里"
这相当于给大模型的内部思维过程装上了一个可读的仪表盘,让研究者看到输出文字背后正在酝酿的概念。
J-space 的 5 个功能特性
Anthropic 为 J-space 识别出五个功能特性,正是这些特性让它像一个真正的"工作空间",而非普通的内部表示。
其中"范围有限"这一点很关键:J-space 不是模型做的所有事都要经过的地方,只有需要"被意识到、参与推理"的信息才会进入,日常的语法和流畅性处理直接绕过它。
关键实验:把"蜘蛛"换成"蚂蚁"
最能说明 J-space 因果作用的实验,是一次概念替换:在 Claude 推理途中,把 J-space 里的"蜘蛛"换成"蚂蚁",模型的回答从"8 条腿"变成了"6 条腿"。
这个实验的意义在于:
● 它证明 J-space 因果性地驱动了输出,而不只是被动反映结果
● 修改内部表示能直接改变最终答案,说明这块空间真的在"参与决策"
配合另一项发现——J-space 模式在网络某些区域的读写连接比普通模式多出约 100 倍——研究者认为这与"广播式中枢(broadcasting hub)"的架构一致:信息进入 J-space 后被广播给整个网络。
一个意外:J-space 是自发涌现的
J-space 最引人深思的一点是,它并非人为设计的结构,而是在训练过程中自发涌现出来的。这暗示:一个"心智工作空间"可能是智能系统的一种通用解法,而不是生物大脑独有的。
进一步的证据来自"删除实验":
● 删掉 J-space 后,模型的流畅度和简单记忆基本不受影响
● 但多步推理能力被削弱到接近零
这说明 J-space 正是大模型完成复杂、多步推理所依赖的核心结构。
J-space 和人脑的全局工作空间有何不同
J-space 借用了神经科学"全局工作空间"的概念,但它与人脑的版本有明显差异,理解这些差异能避免过度类比。
● 缺少循环回路:人脑全局工作空间有递归循环,J-space 没有
● 基于词而非多模态:人脑工作空间是多模态的,J-space 是以词为基础的
● 记忆持久性更强:借助注意力机制,J-space 在记忆保持上反而比人脑更强
也就是说,它在结构上不完全等同于人脑,某些方面更弱、某些方面更强。
关于"意识":功能可达 ≠ 主观体验
Anthropic 明确区分了两种"意识",避免读者把这项研究误读为"Claude 有了意识"。这是解读这项研究时最需要把握的边界。
● 访问意识(access consciousness):功能层面的——想法可被报告、可被控制、能引导推理。J-space 支持这一层。
● 现象意识(phenomenal consciousness):主观体验层面的——"感受"本身。研究不对此作任何断言。
Anthropic 的原话是:“我们的实验并不表明 Claude 能拥有体验,或像人类那样感受事物。“换言之,J-space 说明的是"模型内部有一个功能性的思维枢纽”,而非"模型有了感觉”。
常见问题
Q:J-space 和思维链(chain-of-thought)是一回事吗?
不是。思维链是模型写出来的、可见的推理文字;J-space 运行在内部激活里,是"没写出来的想法"。Claude 可以在 J-space 里想一个概念却不输出它。Q:Jacobian Lens 是怎么读出模型"在想什么"的?
对词表中每个词,它找出会提高该词未来出现概率的内部激活模式,逐层应用后得到一份随推理演变的概念清单,相当于模型思维的可读仪表盘。Q:J-space 是研究者设计出来的吗?
不是。它是在训练中自发涌现的,这暗示"心智工作空间"可能是智能系统的通用解法,而非生物大脑独有。Q:删除 J-space 会怎样?
模型的流畅度和简单记忆基本不受影响,但多步推理能力会被削弱到接近零,说明它是复杂推理的核心结构。Q:这项研究是否意味着 Claude 有意识了?
不能这样理解。研究只支持"访问意识"(功能性、可报告、可控制的想法),对"现象意识"(主观体验)不作任何断言。Anthropic 明确表示实验不表明 Claude 能像人类那样感受事物。总结
Anthropic 2026 年 7 月的研究在 Claude 内部发现了一个自发涌现的"全局工作空间"——J-space:一小组类似人脑全局工作空间的神经模式,具备可报告、可自主控制、参与因果推理、灵活复用、范围有限五大特性。借助 Jacobian Lens 技术,研究者得以读出模型"没说出口的想法",并通过"蜘蛛换蚂蚁"等实验证明它因果性地驱动推理;删除它则会让多步推理能力几近归零。
需要强调的是,这项研究谈的是功能层面的"访问意识",而非主观体验,Anthropic 明确不主张 Claude 拥有感受。本文内容基于 Anthropic 官方研究《A Global Workspace in Language Models》(2026 年)整理,完整论文与开源实现可查阅官方来源,建议以原文为准。
延伸资源
● Anthropic 官方研究:anthropic.com/research/global-workspace
● 完整论文:transformer-circuits.pub
● 开源实现:GitHub(anthropics/jacobian-lens)