主要来源Anthropic: Research
查看原文事件专题 · 官方一手
Anthropic研究发现Claude存在保持内部思考的全局工作空间
Anthropic在2026年7月发表的可解释性研究中,发现Claude模型存在一个涌现的全局工作空间(global workspace)。该空间能保存模型内部的思考过程,但这些内部表示并不会出现在模型的最终输出中。研究利用探针和激活干预技术,定位了Claude中对应全局工作空间的神经元群体。这项工作为理解语言模型的内部推理机制提供了新视角。
当前结论
Anthropic发现了Claude藏着的一个“内心独白”空间,内部思考不写到输出里,搞AI可解释性的人必看。
11 个信源72° AI 热度最后更新 2026/7/6 20:54:29
证据链
相关来源 1歸藏(guizang.ai)
查看原文相关来源 2elvis
查看原文相关来源 3小互
查看原文相关来源 4AI Will
查看原文相关来源 5Decoder
查看原文相关来源 6berryxia
查看原文相关来源 7量子位
查看原文相关来源 8IT之家
查看原文相关来源 9Simon Willison’s Weblog
查看原文相关来源 10shao__meng
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。