11:40官方账号arXiv cs.LG@Namgyu Ho, Huzama Ahmad, Woosung Koh, Se-Young Yun, Tal Schuster, Cicero Nogueira dos Santos78°研究团队提出声明式注意力(DA)协议,让模型在思维链中声明需要关注的内容区域。该协议将生成分为全局、聚焦和局部三种模式,在15个长上下文任务中,Gemma-4-31B和Qwen-3.6-27B模型解码时关注token分别减少52.0%和31.1%,准确率仅下降1.27pp和2.75pp。论文声明式注意力Gemma-4-31BQwen-3.6-27B推荐理由:新DA协议让模型自己决定关注哪部分内容,大幅减少计算量,Gemma和Qwen模型效果显著。原文稍后读已读值得跟进有用关注 声明式注意力