blackwell·general

Blackwell

别名
首次出现
2026-05-22
最近出现
2026-07-24
累计提及
207
§ 01综述

Blackwell 是英伟达推出的新一代 GPU 架构,专注于 AI 推理与训练的高效计算,其核心优势在于通过 FP4 量化、投机解码等技术大幅降低 Token 成本并提升吞吐量。

Blackwell 近期进展

  • DeepSeek V4 推理成本骤降:英伟达利用 Blackwell 架构优化了 DeepSeek V4 的推理过程,单 Token 成本降至原来的五分之一,吞吐量提升 20 倍,彰显了硬件与算法协同集成的巨大潜力。英伟达 Blackwell 优化 DeepSeek V4 推理:单 Token 成本降至 1/5,吞吐量提升 20 倍
  • 大规模 AI 工厂部署:Firmus 计划在印度尼西亚建设 360MW 的 AI 工厂,导入 17 万颗英伟达 GPU,其中 Blackwell 架构有望成为主力,推动可持续 AI 基础设施建设。Firmus 将在印尼建 360MW AI 工厂,导入 17 万颗 NVIDIA GPU
  • FP4 量化与投机解码实用化:英伟达发布了 GLM-5.2 的 NVFP4 量化版本,在 vLLM 上内存减半且精度不变;同时 DFlash 投机解码技术在 Blackwell 上实现并行起草整块 token,吞吐量提升最高 15 倍。vLLM 集成 DFlash 投机解码,Gemma-4 31B 吞吐量提升最高 5.8 倍
  • 当前焦点与观察点

    当前焦点集中在两方面:一是 Blackwell 架构如何与推理引擎(如 vLLM、SGLang)深度融合,通过量化、投机解码等手段释放性能;二是其在大规模部署中的能效与成本优势,尤其在 AI 工厂场景中。同时,OpenAI 自研芯片 Jalapeño 声称性能媲美 Blackwell,凸显了市场竞争的升温。总体看,Blackwell 正成为 AI 推理领域的重要基准,但定制化芯片与开源生态的挑战仍在持续。

    § 02相关报道10 条在档
    1. 01
      英伟达向AIC发涨价通知,显卡厂商全面封仓暂停出货
      IT之家
    2. 02
      英伟达向美国海军研究生院捐赠 GB300 超算,系美军首次部署其最先进 AI 服务器
      IT之家
    3. 03
      摩根士丹利预估2031年SpaceX轨道AI算力每年每瓦6.5美元,低于英伟达地面方案
      IT之家
    4. 04
      DeepSeek-v3 671B 测试:英伟达 Blackwell GB300 刷新 MoE 预训练世界纪录
      IT之家
    5. 05
      英伟达公开 Rubin GPU 细节:3360亿晶体管,智能体AI性能提升10倍
      IT之家
    6. 06
      纬创资通美国首家半导体工厂投产英伟达GB300和Vera Rubin芯片
      IT之家
    7. 07
      NVIDIA Blackwell Ultra 创纪录:预训练 DeepSeek-V3 671B 达 1648 TFLOPS/GPU
      NVIDIA AI
    8. 08
      美供应商推理Kimi K3成本争议:非10倍,实为2-5倍更便宜
      @koltregaskes
    9. 09
      英伟达 N1X 芯片 Cinebench 2026 跑分曝光,单核性能接近苹果 M3 Max
      IT之家
    10. 10
      英伟达 RTX Spark 首批 Win11 Arm 驱动发布,最高 6144 Blackwell 核心
      IT之家
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/Blackwell