主要来源marktechpost
查看原文事件专题 · 官方一手
NVIDIA 发布 Nemotron 3 Ultra:550B 混合专家模型,专为长时智能体设计
NVIDIA 发布了 Nemotron 3 Ultra,一个 550B 总参数(55B 激活)的开放混合专家模型,采用 Mamba-Transformer 混合架构。该模型支持 100 万 token 的上下文窗口,推理吞吐量比同等精度的开放 LLM 高约 6 倍。NVIDIA 同时开源了模型权重、训练数据和配方,遵循 OpenMDW-1.1 许可。这一发布旨在解决长时运行智能体在推理效率和上下文长度上的瓶颈,为 AI 代理和复杂任务自动化提供了更高效的基础模型。
当前结论
长时智能体开发者终于有了一个兼顾超长上下文和高推理效率的开放模型——Nemotron 3 Ultra 的 6 倍吞吐量提升能显著降低部署成本,做 Agent 或 RAG 系统的团队值得直接试。
11 个信源83° AI 热度最后更新 2026/6/4 21:42:28
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2elvis
查看原文相关来源 3lmarena.ai
查看原文相关来源 4Paul Couvert
查看原文相关来源 5ollama
查看原文相关来源 6rohanpaul_ai
查看原文相关来源 7Aravind Srinivas
查看原文相关来源 8Geek
查看原文相关来源 9Fireworks AI
查看原文相关来源 10Perplexity
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。