Anthropic宣布:Claude自己长出了意识
教会模型怎么「说」,塑造了它怎么「想」。
09
那,它有意识吗
说这么多意识科学的概念,这个问题终究是躲不掉的。
Anthropic 的回答有些克制:这些实验不能证明 Claude 拥有体验、或者像人类一样有感受。事实上,可能没有任何实验能证明或证伪这件事。
但哲学家们通常把「能拥有体验」(现象意识,phenomenal consciousness)和另一个纯功能性的概念区分开:可及意识(access consciousness)。一个念头如果你能报告它、用它推理、拿它指导行动,它就是「可及」的。
而 J-space 则支持起这一整套功能:它装着 Claude 能报告、能主动调用、能用来推理的念头,其余处理则在底下自动运行。
更关键的是,这套结构没人设计,是训练中自己长出来的。
这意味着支持意识可及的心智工作空间可能不是人脑接线方式的特例,而是智能系统为了解决某类问题会普遍收敛到的方案。
当然,Claude 的工作空间和人脑也有很大的差异。
人脑的工作空间靠循环回路维持,信号在同一批环路里反复打转;Claude 的工作空间只在一次前向传播里演化,用网络深度顶替了时间的角色。
但另一方面,人类的工作记忆几秒就衰退,Claude 靠注意力机制可以直接调取文本中任何位置缓存过的记忆,这点反而比人强。
以及在内容模态上,人类的意识思维有图像、声音、动作计划等多种格式,Claude 的工作空间几乎全是词,毕竟……说话是它唯一能做的动作。
Anthropic 还请了一圈外部专家来写独立评论:
包括全局神经工作空间理论的两位奠基人 Stanislas Dehaene 和 Lionel Naccache,研究 AI 意识与道德地位的 Eleos AI 团队,以及 Google DeepMind 可解释性负责人 Neel Nanda。Neel Nanda 的评论里还附带了在开源模型上对部分发现的独立复现。
至于「AI 有没有意识」这个终极问题,Anthropic 表示:
不确定我们是否已经走到了那座桥,但是是时候,开始认真思考了。
造出真正拥有体验的系统会带来非常棘手的伦理问题,处理它需要哲学家、科学家、宗教领袖、政府和公众一起下场。
研究论文和方法、代码都已经开源,Anthropic 还和 Neuronpedia 合作做了个交互式演示,可以在开源模型上直接玩 J-lens,若有兴趣可以上手去试试。
◇ ◆ ◇
博客原文:https://www.anthropic.com/research/global-workspace
完整论文:https://transformer-circuits.pub/2026/workspace/index.html
专家评论(Dehaene、Nanda 等):https://www-cdn.anthropic.com/files/4zrzovbb/website/cc4be2488d65e54a6ed06492f8968398ddc18ebe.pdf
Neuronpedia 交互演示:https://neuronpedia.org/jlens
官方推文:https://x.com/AnthropicAI/status/2074185348142280912
[物价飞涨的时候 这样省钱购物很爽]
还没人说话啊,我想来说几句
09
那,它有意识吗
说这么多意识科学的概念,这个问题终究是躲不掉的。
Anthropic 的回答有些克制:这些实验不能证明 Claude 拥有体验、或者像人类一样有感受。事实上,可能没有任何实验能证明或证伪这件事。
但哲学家们通常把「能拥有体验」(现象意识,phenomenal consciousness)和另一个纯功能性的概念区分开:可及意识(access consciousness)。一个念头如果你能报告它、用它推理、拿它指导行动,它就是「可及」的。
而 J-space 则支持起这一整套功能:它装着 Claude 能报告、能主动调用、能用来推理的念头,其余处理则在底下自动运行。
更关键的是,这套结构没人设计,是训练中自己长出来的。
这意味着支持意识可及的心智工作空间可能不是人脑接线方式的特例,而是智能系统为了解决某类问题会普遍收敛到的方案。
当然,Claude 的工作空间和人脑也有很大的差异。
人脑的工作空间靠循环回路维持,信号在同一批环路里反复打转;Claude 的工作空间只在一次前向传播里演化,用网络深度顶替了时间的角色。
但另一方面,人类的工作记忆几秒就衰退,Claude 靠注意力机制可以直接调取文本中任何位置缓存过的记忆,这点反而比人强。
以及在内容模态上,人类的意识思维有图像、声音、动作计划等多种格式,Claude 的工作空间几乎全是词,毕竟……说话是它唯一能做的动作。
Anthropic 还请了一圈外部专家来写独立评论:
包括全局神经工作空间理论的两位奠基人 Stanislas Dehaene 和 Lionel Naccache,研究 AI 意识与道德地位的 Eleos AI 团队,以及 Google DeepMind 可解释性负责人 Neel Nanda。Neel Nanda 的评论里还附带了在开源模型上对部分发现的独立复现。
至于「AI 有没有意识」这个终极问题,Anthropic 表示:
不确定我们是否已经走到了那座桥,但是是时候,开始认真思考了。
造出真正拥有体验的系统会带来非常棘手的伦理问题,处理它需要哲学家、科学家、宗教领袖、政府和公众一起下场。
研究论文和方法、代码都已经开源,Anthropic 还和 Neuronpedia 合作做了个交互式演示,可以在开源模型上直接玩 J-lens,若有兴趣可以上手去试试。
◇ ◆ ◇
博客原文:https://www.anthropic.com/research/global-workspace
完整论文:https://transformer-circuits.pub/2026/workspace/index.html
专家评论(Dehaene、Nanda 等):https://www-cdn.anthropic.com/files/4zrzovbb/website/cc4be2488d65e54a6ed06492f8968398ddc18ebe.pdf
Neuronpedia 交互演示:https://neuronpedia.org/jlens
官方推文:https://x.com/AnthropicAI/status/2074185348142280912
[物价飞涨的时候 这样省钱购物很爽]
| 分享: |
| Note: | _VIEW_NEWS_FULL |
| 延伸阅读 |
推荐:
Anthropic宣布:Claude自己长出了意识