事件专题 · 多源确认

Anthropic发现Claude内部推理空间J-Space,可读可操控

Anthropic新研究发现Claude内部存在一个名为J-Space的全局工作空间,与链式推理或草稿板不同,它是训练中自发出现的推理机制。通过J-Space,研究者可以直接读取和修改模型内部的信息流动。实验表明,该方法首次实现了对模型推理过程的直接观测和操控,而非仅从输出文本推测。这为可解释性提供了新工具,可能用于验证模型行为、实施更好护栏和预测危险场景。

当前结论

Anthropic找到了Claude思考时的内部工作区J-Space,能看能改,比以往猜输出靠谱多了。

11 个信源88° AI 热度最后更新 2026/7/6 22:47:59

证据链

相关来源 3歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情