论文Agent 与开发者12:13SAEScientist-Bench:AI代理能否自主进行SAE可解释性研究这个基准测试了AI代理能否自主进行稀疏自编码器研究,发现代理能设计对比实验但常误解测量结果。#SAEScientist-Bench#SAE#Gemma-2-9B-IT#可解释性aarXiv cs.AI@Yuqiao Tan 等 4 人原文稍后读已读值得跟进有用关注 SAEScientist-Bench