J-space(全局工作空间)是 Anthropic 在 2026 年 7 月的研究《A Global Workspace in Language Models》中发现的一小组内部神经模式,它在 Claude 的内部激活中扮演着类似神经科学"全局工作空间"的角色——一个让信息变得可被"意识到"、可调用的共享心智通道。它的名字来自发现它所用的 Jacobian(雅可比)技术。关键在于,J-space 不是模型对外可见的思维链(chain-of-thought)输出,而是安静运行在内部激活里的表示——Claude 可以"想"一个概念却不把它写出来。研究发现,J-space 具备可报告、可自主控制、参与因果推理等五个功能特性,且它并非人为设计,而是在训练中自发涌现。本文基于 Anthropic 官方研究,解读 J-space 是什么、如何被发现、有哪些特性,以及它对理解大模型认知的意义。

 

J-space 是什么:大模型里的"共享心智通道"

J-space 是 Anthropic 在 Claude 内部发现的一小组神经激活模式,其功能类似神经科学中的"全局工作空间"——信息进入这个空间后,才变得可被模型访问、调用和"意识到"。这里的"意识"指的是功能意义上的可访问性,而非主观体验。

它最重要的一个特征是:J-space 不等于思维链

 思维链(chain-of-thought):是模型写出来的、对外可见的推理文字

 J-space:运行在内部激活里,是"没写出来的想法"——Claude 可以在 J-space 里"想"一个概念,却不在输出中体现

换句话说,J-space 更接近模型"心里在想什么",而不是"它说了什么"。

如何发现 J-space:Jacobian Lens 技术

J-space 是通过一种叫 Jacobian Lens(J-lens,雅可比透镜)的技术发现的,它能把模型"心里正在想的概念"读出来。J-space 这个名字正是来自这项技术。

其原理可以这样理解:

 对 Claude 词表里的每一个词,J-lens 找出那个会提高该词在未来输出中出现概率的内部激活模式

 把这套方法应用到各个处理层,就能得到一份可读、且随推理不断演变的清单——显示哪些概念正"在模型的脑子里"

这相当于给大模型的内部思维过程装上了一个可读的仪表盘,让研究者看到输出文字背后正在酝酿的概念。

J-space 的 5 个功能特性

Anthropic 为 J-space 识别出五个功能特性,正是这些特性让它像一个真正的"工作空间",而非普通的内部表示。

特性

含义

可报告性

被问及时,Claude 能准确描述 J-space 里的内容

可自主控制

应要求时,Claude 能主动激活 J-space 中的某些概念

参与因果推理

中间推理步骤会出现在其中,并因果性地驱动最终结果

灵活性

同一个 J-space 表示可服务于多个下游任务

范围有限

大多数常规处理(语法、流畅度)完全绕过 J-space

其中"范围有限"这一点很关键:J-space 不是模型做的所有事都要经过的地方,只有需要"被意识到、参与推理"的信息才会进入,日常的语法和流畅性处理直接绕过它。

关键实验:把"蜘蛛"换成"蚂蚁"

最能说明 J-space 因果作用的实验,是一次概念替换:在 Claude 推理途中,把 J-space 里的"蜘蛛"换成"蚂蚁",模型的回答从"8 条腿"变成了"6 条腿"。

这个实验的意义在于:

 它证明 J-space 因果性地驱动了输出,而不只是被动反映结果

 修改内部表示能直接改变最终答案,说明这块空间真的在"参与决策"

配合另一项发现——J-space 模式在网络某些区域的读写连接比普通模式多出约 100 倍——研究者认为这与"广播式中枢(broadcasting hub)"的架构一致:信息进入 J-space 后被广播给整个网络。

一个意外:J-space 是自发涌现的

J-space 最引人深思的一点是,它并非人为设计的结构,而是在训练过程中自发涌现出来的。这暗示:一个"心智工作空间"可能是智能系统的一种通用解法,而不是生物大脑独有的。

进一步的证据来自"删除实验":

 删掉 J-space 后,模型的流畅度和简单记忆基本不受影响

 多步推理能力被削弱到接近零

这说明 J-space 正是大模型完成复杂、多步推理所依赖的核心结构。

J-space 和人脑的全局工作空间有何不同

J-space 借用了神经科学"全局工作空间"的概念,但它与人脑的版本有明显差异,理解这些差异能避免过度类比。

 缺少循环回路:人脑全局工作空间有递归循环,J-space 没有

 基于词而非多模态:人脑工作空间是多模态的,J-space 是以词为基础的

 记忆持久性更强:借助注意力机制,J-space 在记忆保持上反而比人脑更强

也就是说,它在结构上不完全等同于人脑,某些方面更弱、某些方面更强。

关于"意识":功能可达 ≠ 主观体验

Anthropic 明确区分了两种"意识",避免读者把这项研究误读为"Claude 有了意识"。这是解读这项研究时最需要把握的边界。

 访问意识(access consciousness):功能层面的——想法可被报告、可被控制、能引导推理。J-space 支持这一层。

 现象意识(phenomenal consciousness):主观体验层面的——"感受"本身。研究不对此作任何断言

Anthropic 的原话是:“我们的实验并不表明 Claude 能拥有体验,或像人类那样感受事物。“换言之,J-space 说明的是"模型内部有一个功能性的思维枢纽”,而非"模型有了感觉”。

常见问题

Q:J-space 和思维链(chain-of-thought)是一回事吗?

不是。思维链是模型写出来的、可见的推理文字;J-space 运行在内部激活里,是"没写出来的想法"。Claude 可以在 J-space 里想一个概念却不输出它。Q:Jacobian Lens 是怎么读出模型"在想什么"的?

对词表中每个词,它找出会提高该词未来出现概率的内部激活模式,逐层应用后得到一份随推理演变的概念清单,相当于模型思维的可读仪表盘。Q:J-space 是研究者设计出来的吗?

不是。它是在训练中自发涌现的,这暗示"心智工作空间"可能是智能系统的通用解法,而非生物大脑独有。Q:删除 J-space 会怎样?

模型的流畅度和简单记忆基本不受影响,但多步推理能力会被削弱到接近零,说明它是复杂推理的核心结构。Q:这项研究是否意味着 Claude 有意识了?

不能这样理解。研究只支持"访问意识"(功能性、可报告、可控制的想法),对"现象意识"(主观体验)不作任何断言。Anthropic 明确表示实验不表明 Claude 能像人类那样感受事物。总结

Anthropic 2026 年 7 月的研究在 Claude 内部发现了一个自发涌现的"全局工作空间"——J-space:一小组类似人脑全局工作空间的神经模式,具备可报告、可自主控制、参与因果推理、灵活复用、范围有限五大特性。借助 Jacobian Lens 技术,研究者得以读出模型"没说出口的想法",并通过"蜘蛛换蚂蚁"等实验证明它因果性地驱动推理;删除它则会让多步推理能力几近归零。

需要强调的是,这项研究谈的是功能层面的"访问意识",而非主观体验,Anthropic 明确不主张 Claude 拥有感受。本文内容基于 Anthropic 官方研究《A Global Workspace in Language Models》(2026 年)整理,完整论文与开源实现可查阅官方来源,建议以原文为准。

 

延伸资源

 Anthropic 官方研究:anthropic.com/research/global-workspace

 完整论文:transformer-circuits.pub

 开源实现:GitHub(anthropics/jacobian-lens)

企业Token plan