主要来源ollama
查看原文事件专题 · 多源确认
NVIDIA Nemotron 3.5 Lightning 登陆 Ollama,30B MoE 模型主打常驻智能体
NVIDIA 的 Nemotron 3.5 Lightning 现已可通过 Ollama 本地运行。这是一款 30B 参数的混合专家模型,仅激活 3B 参数,支持 1M token 上下文。该模型专为常驻运行的智能体设计,擅长编码、工具调用和多轮对话。相比同类规模的开源模型,其吞吐量提升 4 倍,任务完成时间降低 30%。用户可通过 Claude Code、Hermes Agent 或 OpenClaw 等工具直接调用。
当前结论
NVIDIA 新出的 30B 模型,跑在本地,专门给常驻智能体用,速度快 4 倍,还支持 1M 上下文,搞智能体的可以试试。
11 个信源58° AI 热度最后更新 2026/8/11 16:02:21
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2AI Will
查看原文相关来源 3Decoder
查看原文相关来源 4Harrison Chase
查看原文相关来源 5Aravind Srinivas
查看原文相关来源 6IT之家
查看原文相关来源 7OpenRouter
查看原文相关来源 8Fireworks AI
查看原文相关来源 9marktechpost
查看原文相关来源 10小互
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。