8月11日
23:34
23:34官方账号Decoder@Matthias Bastian
精选
Nvidia发布开源权重模型Nemotron 3.5 Lightning,仅36亿活跃参数,在智能指数上与OpenAI的gpt-oss-120b持平,但体积小四倍。该模型每秒处理近670个token,是对比中速度最快的模型。Nvidia此举表明其更注重效率而非模型规模。
事件专题

推荐理由:Nvidia新出的开源模型,36亿参数跑得比1200亿的还快,速度拉满,适合追求低延迟的开发者。
22:02
22:02官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA推出Nemotron 3.5 Lightning,专为长时间运行的智能体工作流优化,覆盖工具调用、结果验证和任务委派等高频执行场景。该模型体积适中,可从DGX Spark到数据中心灵活部署。NVIDIA展示了其在DGX Spark上运行智能体工作流的实例,并提供了技术细节文档。
事件专题

推荐理由:NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。