AI模型精选76°

深圳团队用华为昇腾910C成功训练万亿参数大模型DeepSeek-V4-Pro

深圳国产芯片成功训练万亿级 AI 大模型:依托华为昇腾 910C,达到工业级运行标准

精选理由

国产芯片终于能跑万亿参数大模型了,做AI基础设施和模型训练的团队值得关注——这证明昇腾910C已具备工业级训练能力,后续国产替代路径更清晰。

AI 摘要

深圳河套学院联合哈工大、华为等团队,依托华为昇腾910C国产AI算力集群,成功完成1.6万亿参数大模型DeepSeek-V4-Pro的全参数后训练。这是全球第三方机构首次在国产算力平台上完成如此规模的模型训练,模型算力利用率超过30%,关键训练算子效率提升14%,达到工业级运行标准。该成果证明国产AI芯片已能支撑世界级超大参数模型训练,为国产算力生态积累了重要经验。

原文 · IT之家

深圳国产芯片成功训练万亿级 AI 大模型:依托华为昇腾 910C,达到工业级运行标准

IT之家 6 月 5 日消息,据“深圳发布”今日消息,深圳河套学院 AI 训练平台项目团队,联合哈尔滨工业大学(深圳)、深圳市大数据研究院、华为有关团队,协同深智城 AI 算力平台,面向国产算力大模型训练开展联合攻关。 依托昇腾 910C 国产 AI 算力集群,完成 1.6 万亿参数大模型 DeepSeek-V4-Pro 全参数后训练 。 此次实践为全球第三方机构在国产算力平台上完成该级别模型训练的相关探索积累了重要经验,也印证了国产 AI 芯片可支撑世界级超大参数模型训练工作。 目前,项目已实现模型算力利用率(MFU)超过 30%,关键训练算子效率提升 14%, 各项指标均达到工业级运行标准 。 从技术应用角度来看,调用已有模型开展业务推理,与从零完成模型全参数训练分属不同技术环节,二者在技术难度、硬件要求上存在明显区别。 本次试验结果表明,国产 AI 算力已可承担顶级大模型训练任务,相关技术路径具备可行性 。 据IT之家此前报道,在去年 9 月的华为全联接大会 2025 上,华为副董事长、轮值董事长徐直军称昇腾芯片将不断演进,更多芯片还在规划。