主要来源NVIDIA AI
查看原文事件专题 · 多源确认
NVIDIA 开源 Nemotron Puzzle 75B MoE 模型,支持 1M 上下文
NVIDIA 开源了 NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 模型,总参数量 75.3B,激活参数 9.3B,采用 MoE 架构。该模型从 Nemotron-3-Super-120B 通过 Iterative Puzzle 框架压缩而来,支持 1M token 上下文长度。模型可运行在单张 GB10 显卡上。
当前结论
NVIDIA 刚开源的 75B MoE 模型,实际只激活 9.3B 参数,单卡就能跑百万 token 上下文,适合长文档或代码分析。
11 个信源74° AI 热度最后更新 2026/7/8 01:37:24
证据链
相关来源 1marktechpost
查看原文相关来源 2elvis
查看原文相关来源 3Aravind Srinivas
查看原文相关来源 4The Rundown AI
查看原文相关来源 5LangChain
查看原文相关来源 6vLLM
查看原文相关来源 7IT之家
查看原文相关来源 8Decoder
查看原文相关来源 9andrew chen
查看原文相关来源 10arXiv cs.AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。