h100·product

H100

别名
首次出现
2026-05-22
最近出现
2026-07-25
累计提及
56
§ 01综述

H100 是英伟达于2022年发布的Hopper架构GPU,专为大规模AI训练和推理设计,凭借其Transformer引擎和高速互联,长期占据高端AI芯片市场的主导地位。其算力峰值达1979 TFLOPS(FP8),但近期面临自研芯片和竞争产品的挑战。

H100 近期进展

  • 2026年7月,英伟达推出压缩混合MoE模型Nemotron-Labs-3-Puzzle-75B-A9B,通过架构优化在保持模型质量的同时将吞吐量提升2.03倍,可有效降低H100等GPU的推理成本。原文标题
  • 2026年7月,Meta推出基于GPU的计算服务,通过向外部客户出租H100等算力实现盈利,此举进一步印证了H100在云服务市场中的核心地位。原文标题
  • 2026年7月,WAIC 2026大会聚焦超节点与光互连技术,探讨如何突破单芯片算力天花板,暗示H100的算力增长已接近物理极限,未来需依赖系统级创新。原文标题
  • 2026年6月,SpaceX在IPO后表示将深化与英伟达的合作,强调H100在航天AI模拟中的关键作用,凸显其在高端计算场景的不可替代性。原文标题
  • 当前焦点与观察点

    当前H100的焦点主要集中在三方面:一是英伟达通过软件优化(如MoE模型压缩)延长H100的实用寿命,降低用户成本;二是云计算厂商(如Meta)将H100作为盈利工具,反映其市场需求依然旺盛;三是来自国产芯片(如每秒520万亿次浮点运算的自研芯片)和新兴互联技术(光互连、超节点)的竞争压力增大。整体看,H100在短期内仍是AI算力的标杆,但长期面临架构迭代和替代方案的双重挑战。

    § 02相关报道10 条在档
    1. 01
      纳德拉:微软自研 MAI 模型在 Excel 任务中性能与 GPT-5.6 相当,部署成本更低
      IT之家
    2. 02
      Shopify CEO Tobi Lutke 获 NVIDIA DGX Workstation 用于本地 AI
      Julien Chaumond
    3. 03
      思科基金会AI发布Antares:350M和1B开源权重组,精准定位代码库已知漏洞
      marktechpost
    4. 04
      微软转向AMD Helios平台,Anthropic或跟进,Nvidia芯片垄断受挑战
      Decoder
    5. 05
      英伟达与丰田扩大合作,开发L2++辅助驾驶汽车及AI应用
      IT之家
    6. 06
      每秒 520 万亿次浮点运算,我国自研 AI 芯片取得架构突破
      IT之家
    7. 07
      压缩混合MoE模型Nemotron-Labs-3-Puzzle-75B-A9B,吞吐量提升2.03倍
      marktechpost
    8. 08
      NVIDIA压缩MoE模型Puzzle-75B-A9B,吞吐量翻倍可保持质量
      elvis
    9. 09
      Meta 推出计算服务,通过 GPU 盈利
      量子位
    10. 10
      微调7B-16B模型成本低至£10-50,运维才是难点
      @koltregaskes
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/H100