high·general

High

别名
首次出现
2026-05-22
最近出现
2026-07-26
累计提及
271
§ 01综述

High 通常指代高性能或高水平的 AI 模型,近期以 GLM-5.2 和 GPT-5.5-Cyber 为代表的新一代模型在编码、推理和智能体任务上取得了显著进展,标志着大型语言模型在实用能力上的又一次跃升。

High 模型近期进展

  • GLM-5.2 登顶 CodeArena 并开源:该模型在编码基准测试中排名第一,以 MIT 协议开源,提供 1M token 上下文窗口和双推理模式(标准与深度思考)。智谱 GLM-5.2 发布并开源,百万上下文与思考力度控制
  • 编码能力达到 Opus 水平:开源权重版本的 GLM-5.2 在编码任务上首次达到此前仅闭源模型才有的水平,聚焦智能体与代码生成场景。GLM-5.2 开源模型编码能力首次达到 Opus 水平
  • GPT-5.5-Cyber 在对抗测试中胜出:该模型在 CyberGym 环境中击败了 Mythos 5,展现出更强的鲁棒性与策略能力,目前已开放申请权限。GPT-5.5-Cyber 在 CyberGym 击败 Mythos 5,申请权限开放
  • REDACT 基准关注多语言隐私检测:OpenAI 发布 REDACT 数据集,用于评估系统在多语言个人信息识别上的控制能力,补充了现有基准的不足。REDACT: 系统控制的多语言个人信息检测基准
  • 当前焦点与观察点

    当前 High 模型的发展呈现三大趋势:一是开源模型与闭源模型的能力差距迅速缩小,GLM-5.2 等开源模型在编码等垂直领域已追上甚至超越闭源对手;二是上下文窗口进一步扩大至百万级别,使长文档处理、复杂智能体任务成为可能;三是安全与对齐问题受到更多关注,如 REDACT 基准的提出凸显了个人信息检测的重要性。不过,这些模型的实际部署成本、推理效率以及幻觉等问题仍需进一步解决。
    § 02相关报道10 条在档
    1. 01
      Ruff v0.16.0 默认规则从 59 增至 413,大幅提升代码检查能力
      Simon Willison’s Weblog
    2. 02
      用户呼吁OpenAI在Codex中加入GPT-5.6 Pro
      @koltregaskes
    3. 03
      Finite-Sample Coverage Audits for High-Recall Candidate Generation
      arXiv cs.LG
    4. 04
      多个模型在IMO 2026获满分,国产模型Qwen3.8和Kimi K3表现出色
      berryxia
    5. 05
      Kimi K3: 2.8万亿参数模型发布,开放权重承诺7月27日
      Simon Willison’s Weblog
    6. 06
      GPT-5.6 Sol Extra High模式消耗大量额度
      @koltregaskes
    7. 07
      GPT 5.6 Ultra模式通过并行Sub-agent提升效率
      向阳乔木
    8. 08
      智谱启动Touch High计划,唐杰称继续聚焦AGI而非短期变现
      IT之家
    9. 09
      OpenAI GPT-5.6 最佳实践:30种搭配与提示词优化
      shao__meng
    10. 10
      OpenAI发布GPT-Live:全双工语音模型,可调用GPT-5.5实时生成UI
      小互
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/High