256k·general

256k

别名
首次出现
2026-05-29
最近出现
2026-07-28
累计提及
55
§ 01综述

256k 通常指模型支持的上下文窗口长度,例如腾讯混元 Hy3 模型支持 256K tokens 的上下文,使其能够处理超长文本。这一指标在国产大模型中较为领先,直接决定了模型处理复杂长文档的能力。

256k上下文模型近期进展

  • 2026年7月6日,腾讯发布 Hy3 开源模型,参数规模 295B,采用 MoE 架构仅 21B 激活参数,支持 256K 上下文,性能超越 GLM-5.1。该模型在多个基准测试中表现优异,并已上线 OpenRouter 平台:腾讯发布Hy3:295B MoE开源模型,21B激活参数,256K上下文
  • 腾讯混元 Hy3 在 OpenRouter 上免费提供至 7 月 21 日,用户可直接体验其 256K 长上下文能力。这一举措吸引了大量开发者试用,导致调用量激增:腾讯混元 Hy3 在 OpenRouter 免费提供至 7 月 21 日
  • 由于 Hy3 模型开源后调用激增,WorkBuddy 已紧急扩容以应对需求。模型支持 vLLM 和 SGLang 等推理框架原生部署,降低了使用门槛:腾讯混元 Hy3 模型开源后调用激增,WorkBuddy 已紧急扩容
  • 当前焦点与观察点

  • ### 256k 上下文对实际应用的影响
  • 256K 的上下文能力使得 Hy3 可以一次性处理数十万字的文档、长篇代码或复杂对话历史,在文档分析、代码审查、智能客服等场景中优势明显。但长上下文对显存和推理速度要求更高,实际部署需权衡成本。
  • ### 开源策略与竞争格局
  • 腾讯选择将 Hy3 开源并短期免费,旨在快速积累生态和口碑。对比同期其他 256K 模型(如 GLM-5.1 的 128K),Hy3 在参数量和上下文长度上形成差异化,但能否长期维持竞争力还需观察后续更新和社区反馈。
    § 02相关报道10 条在档
    1. 01
      微软发布MAI-Cyber-1-Flash:5B活跃参数网络防御模型,MDASH在CyberGym达95.95%
      marktechpost
    2. 02
      QQ 宠物全新升级归来,接入腾讯 Hy3 大模型
      IT之家
    3. 03
      蚂蚁Ling团队发布Ling-3.0-flash,124B MoE模型激活仅5.1B参数
      vLLM
    4. 04
      腾讯混元发布Hy3模型,支持256K上下文与Go语言
      Hunyuan
    5. 05
      腾讯混元Hy3限免活动延长至8月5日
      IT之家
    6. 06
      Thinking Machines发布975B多模态MoE模型Inkling
      elvis
    7. 07
      OpenMOSS 开源实时视频流多模态模型 MOSS-VL-Realtime
      berryxia
    8. 08
      GPT-5.5百万token上下文准确率仅36%,工程师称为“上下文腐烂”
      AI Will
    9. 09
      GPT-5.5百万token上下文检索准确率从80%降至36%:context rot问题
      AI Will
    10. 10
      腾讯Hy3模型发布:295B MoE仅21B活跃参数,性能超越GLM-5.1
      Hunyuan
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/256k