主要来源elvis
查看原文事件专题 · 多源确认
Anthropic发现Claude内部推理空间J-Space,可读可操控
Anthropic新研究发现Claude内部存在一个名为J-Space的全局工作空间,与链式推理或草稿板不同,它是训练中自发出现的推理机制。通过J-Space,研究者可以直接读取和修改模型内部的信息流动。实验表明,该方法首次实现了对模型推理过程的直接观测和操控,而非仅从输出文本推测。这为可解释性提供了新工具,可能用于验证模型行为、实施更好护栏和预测危险场景。
当前结论
Anthropic找到了Claude思考时的内部工作区J-Space,能看能改,比以往猜输出靠谱多了。
11 个信源88° AI 热度最后更新 2026/7/6 22:47:59
证据链
相关来源 1Anthropic
查看原文相关来源 2berryxia
查看原文相关来源 3歸藏(guizang.ai)
查看原文相关来源 4小互
查看原文相关来源 5AI Will
查看原文相关来源 6IT之家
查看原文相关来源 7Decoder
查看原文相关来源 8量子位
查看原文相关来源 9shao__meng
查看原文相关来源 10lmarena.ai
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。