事件专题 · 多源确认

Anthropic论文发现Claude模型内部存在类似人脑的“全局工作空间”结构

Anthropic发布论文《大语言模型中的全局工作空间》,在Claude模型中发现了类似神经科学“全局工作空间理论”的结构,命名为J-space。他们开发了J-lens数学工具来弱化后台任务干扰,聚焦Claude在特定时刻关注的概念。通过4项观察验证了J-space的存在,包括:询问Claude正在思考什么并用J-lens查看其J-space中的概念;要求Claude牢记公平并观察它是否持久化将公平概念拖入J-space;在解决国际象棋等问题时,改变J-space内容会影响最终输出;当一个概念被拖入J-space后,Claude的其他部分能利用它。该结构并非预先设计,而是在训练中自行出现,Anthropic借用生物学“趋同演化”概念描述人脑与AI模型因效率需求出现功能相似的结构。

当前结论

Anthropic用生物学概念解释了Claude内部如何组织信息,还拿出了4个实验证据,就像给AI做了个脑电图。

11 个信源66° AI 热度最后更新 2026/7/7 06:41:52

证据链

相关来源 6歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情