主要来源AI Will
查看原文事件专题 · 多源确认
NVIDIA发布Nemotron 3.5 Lightning,面向长时智能体执行
NVIDIA推出Nemotron 3.5 Lightning,专为长时运行的智能体任务设计。该模型总参数量30B,激活参数3B,支持高达1M token的上下文,并已开放商用。NVIDIA提供BF16和更小的NVFP4量化检查点,支持在单张H100或DGX Spark上部署,也兼容RTX 5090。通过多token预测、DSpark和DFlash投机解码以及NVFP4量化,生成速度最高提升4倍。在PinchBench基准上,其准确率达86%,完成速度比Qwen3.6 35B快30%。
当前结论
NVIDIA出了个轻量模型,30B参数但只激活3B,跑长任务上下文能到1M,单卡就能部署,速度还快4倍。
11 个信源58° AI 热度最后更新 2026/8/12 06:41:07
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2Decoder
查看原文相关来源 3ollama
查看原文相关来源 4Aravind Srinivas
查看原文相关来源 5IT之家
查看原文相关来源 6Fireworks AI
查看原文相关来源 7Harrison Chase
查看原文相关来源 8OpenRouter
查看原文相关来源 9marktechpost
查看原文相关来源 10Julien Chaumond
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。