#Nemotron 3.5 Lightning
英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。
跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。
Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。
NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。
英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。
CodeRabbit用不到100美元和三小时微调了NVIDIA新模型,比原来的GPT级模型准确率高4%,推理成本还省一半,想省钱的可以看看。
Applied Compute 支持 Nemotron 3.5 Lightning 了,并发翻 16 倍延迟不涨,训练迭代快多了。
CrowdStrike 用 Nemotron 3.5 Lightning 做了安全智能体,自动关掉 88% 误报,训练快又省算力。
NVIDIA 的 Nemotron 3.5 Lightning 微调后,在 6 项任务上超过 4 个同类 MoE 模型拿了第一。想知道怎么调出来的,可以看这篇。
NVIDIA 把 30B MoE 的 Lightning 放到 Perplexity API 上了,每百万输入才 1 分多钱,适合跑高频工具调用,跟 Ultra 搭配干活很划算。
LangChain创始人亲自下场点赞,还要集成到deepagents里,说明Nemotron 3.5 Lightning对智能体开发是真有用,搞AI代理的可以关注下。
Ollama和NVIDIA联手了,新出的Nemotron 3.5 Lightning主打快和高效,还是开源的,做智能体可以试试。
NVIDIA 新出的 30B 模型,跑在本地,专门给常驻智能体用,速度快 4 倍,还支持 1M 上下文,搞智能体的可以试试。
NVIDIA 新出的 30B MoE 模型,3B 激活参数跑得快,专为智能体场景优化,Fireworks 上直接能用。
NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。