#J-space
共 8 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「J-space」标签的资讯、产品与论文,按刊登时间排,新的在上。
7月7日
Anthropic 发现 Claude 内部存在类似全局工作空间理论的 J-space 机制
Anthropic 用新可解释性技术找到了 Claude 内部的 J-space,类似大脑的全局工作空间,搞明白了模型怎么处理想法。适合关心 AI 可解释性的人看。
Anthropic发现Claude内部J-space机制,实现隐藏推理
Anthropic发现Claude有个隐藏的“思考空间”J-space,模型能在里面默默推理,不写出来。删掉它复杂推理就变差,还能看到模型私下的想法,挺有意思。
Anthropic发布J-space论文:可读取和塑造Claude的思考过程
Anthropic这次直接打开了Claude的思维黑箱,能用J-space看它在想什么,还能干预调整,对AI安全来说是个新思路。