论文多源确认09:56ATFlash:按 RoPE 波长分窗的注意力剪枝方法ATFlash 在 1M token 上下文把 Qwen2.5-7B 提速 1.31 倍,精度不掉,而且能直接叠加现有稀疏方法。#ATFlash#RoPE#FlashAttention#长上下文3 个信源在谈事件专题aarXiv: OpenAI@Shun-ichiro Hayashi 等 4 人4 个信源在谈原文稍后读已读值得跟进有用关注 ATFlash