256k

general · 首次出现 2026-05-29 · 最近出现 2026-09-09 · 累计提及 80

综述

markdown

256k 定义与定位


256k 是指大模型能够处理的长文本上下文长度参数,代表模型一次可承载的文本字符数量规模,是衡量大模型长上下文处理能力的关键指标。

256k 近期进展

KVMem提升长上下文推理效率:KVMem技术优化后,大模型在处理超长文本时效率显著提升,为256k级别上下文场景提供更流畅推理体验。 阿里开源Qwen3.8 - 2.4T - A95B:2.4T MoE、激活95B、原生256K上下文:阿里推出Qwen3.8模型,原生支持256k上下文,结合2.4T MoE和95B激活参数,拓展大模型长文本处理边界。 DeepSeek - V4 长上下文服务系统 RedKnot - MLA 发布:DeepSeek发布V4系统,RedKnot - MLA针对256k级长上下文场景优化,提升多模态任务处理性能。 科大讯飞发布星火X2.5模型:讯飞星火X2.5模型在长上下文处理上支持256k参数,推动行业对大模型长文本能力的持续探索。

当前焦点与观察点

当前大模型领域围绕256k上下文的技术竞争愈发激烈,各厂商通过算法和硬件协同优化,提升长文本处理效率。从现有成果看,不同模型在256k场景下既有基础参数升级,也有特定任务化优化,整体处于技术迭代加速阶段。未来随着算力成本下降,256k级别大模型应用场景有望更广泛,成为大模型技术发展重要方向。

相关报道

10 条在档