事件专题 · 单一信源

HOLA:为线性注意力引入海马体互补存储,提升长程召回

HOLA论文提出为线性注意力添加海马体互补存储,保留delta-rule状态的压缩记忆并增加一个有限精确KV缓存,形成半参数测试时记忆。在340M参数、15B SlimPajama tokens训练下,WikiText困惑度从27.32降至22.92,低于全注意力Transformer++的26.88。在RULER needle recall测试中,HOLA在32k tokens(16倍训练长度)上保持稳健。

当前结论

线性注意力一直有长程遗忘问题,HOLA用一个小缓存就解决了,在32k长度上效果惊人。

2 个信源52° AI 热度最后更新 2026/7/3 15:38:01

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情