14:24IT之家(博客/媒体)82°英伟达宣布其 Blackwell GB300 在 256 块 GPU 上预训练 DeepSeek-v3 671B 模型,每 GPU 算力达到 1648 TFLOPs,刷新 MoE 预训练世界纪录。相比 2025 年 11 月的 1088 TFLOPs,性能优化提升 50%。与上一代 GB200 的 606 TFLOPs 相比,GB300 实现了约 3 倍性能跃升。英伟达通过模拟超过 25 万种配置,发现 38 项优化方案,累计进行 140 万小时 GPU 优化测试。AI模型DeepSeek-v3英伟达Blackwell推荐理由:英伟达用 Blackwell GB300 跑 DeepSeek-v3,每 GPU 1648 TFLOPs,比上一代快 3 倍,技术优化真猛。原文稍后读已读值得跟进有用关注 DeepSeek-v3