全部动态

AI 相关资讯全量信息流 · 321 条
5月13日
论文官方一手21:35
机械论(不)忠实性的玩具模型:transcoder 出错时

做 AI 可解释性研究的人会直接受益——这篇论文揭示了 transcoder 可能产生虚假特征的根本原因,看完会对现有方法的可靠性有更清醒的认识。建议所有用稀疏自编码器做模型分析的人点开。

事件专题
官方一手Anthropic: Transformer Circuits2 个信源在谈原文