Attention
general · 首次出现 2026-05-22 · 最近出现 2026-09-11 · 累计提及 376
综述
相关报道
10 条在档- Google DeepMind发布声明注意力机制论文elvis
- TuringLLM推出20B参数专家混合模型arXiv cs.AI
- LoGo: Token-Level Dynamic Local-Global AttentionarXiv cs.LG
- 阿里Qwen团队发布Qwen3.8-Flash-Next:125B多模态MoE模型,预览Qwen4架构marktechpost
- Qwen3.8-Flash-Next在NVIDIA和AMD上运行阿里通义 Qwen
- TANGO: Token-Aggregated Nonlinear Gating Operators for Natural and Formal Language ModelingarXiv: Google DeepMind
- Prompt-Conditioned Channel Attention for Hierarchical Feature Modulation toward Anatomy-Agnostic SegmentationarXiv cs.AI
- Lévy Attention模型发布 新增连续时间不确定性预测arXiv cs.LG
- Proteus:增量记忆激活用于长上下文序列建模arXiv cs.LG
- LongCat稀疏注意力:流式感知分层跨层索引arXiv: DeepSeek