128k
general · 首次出现 2026-05-28 · 最近出现 2026-09-12 · 累计提及 54
综述
相关报道
10 条在档- 上下文窗口越长越好?8B 模型学会整理记忆后,32K 打败 128K 自己shao__meng
- TuringLLM推出20B参数专家混合模型arXiv cs.AI
- 韩国 Solar Pro 4 亮相 Agent Arena,与 MiniMax M2.7 同级IT之家
- Meta 开源 Muse Glimmer 30B 模型,上线 FireworksFireworks AI
- Anthropic 取消 Claude Sonnet 5 涨价计划,永久维持首发优惠价IT之家
- Meta 开源 Muse Glimmer 30B,vLLM 首日支持NVIDIA AI
- DeepSeek V4 Flash 家用部署实测:单机峰值 1875 tok/sGeek
- ATFlash:按 RoPE 波长分窗的注意力剪枝方法arXiv: OpenAI
- OpenAI 发布 ChatGPT 更新日志@OpenAIDevs
- 全球首个Agentic扩散模型:边行动边纠错,128K上下文追平自回归量子位