论文官方一手21:35Transformer Circuits 八月更新:可解释性评估与自解释复现对于从事 AI 可解释性研究的开发者,这些更新提供了评估模型内部机制的新工具,值得关注并尝试应用到自己的工作中。#可解释性#Transformer Circuits#评估框架#自解释A官方一手Anthropic: Transformer Circuits原文稍后读已读值得跟进有用关注 可解释性