事件专题 · 官方一手

Anthropic研究发现Claude存在保持内部思考的全局工作空间

Anthropic在2026年7月发表的可解释性研究中,发现Claude模型存在一个涌现的全局工作空间(global workspace)。该空间能保存模型内部的思考过程,但这些内部表示并不会出现在模型的最终输出中。研究利用探针和激活干预技术,定位了Claude中对应全局工作空间的神经元群体。这项工作为理解语言模型的内部推理机制提供了新视角。

当前结论

Anthropic发现了Claude藏着的一个“内心独白”空间,内部思考不写到输出里,搞AI可解释性的人必看。

11 个信源72° AI 热度最后更新 2026/7/6 20:54:29

证据链

主要来源Anthropic: Research
查看原文
相关来源 1歸藏(guizang.ai)
查看原文
相关来源 9Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情