英伟达新出的30B开源模型,跑智能体任务比同类快4倍,还能本地跑,搞多智能体开发的可以试试。
英伟达于8月11日发布Nemotron 3.5 Lightning,这是一款拥有300亿参数的MoE开源模型,专为大型多智能体系统设计。相比同类模型,其输出速度最高提升4倍,智能体任务整体完成速度加快30%。该模型支持本地运行于NVIDIA RTX PC、DGX Spark等设备,也可扩展至企业级数据中心和云端环境。开源链接已提供在Hugging Face、ModelScope和OpenRouter等平台。
英伟达推出 30B 开源 AI 模型 Nemotron 3.5 Lightning
IT之家 8 月 12 日消息,当地时间 8 月 11 日,英伟达宣布推出 30B 开源 AI 模型 Nemotron 3.5 Lightning,进一步丰富其 Nemotron 3 模型系列。 官方表示,Nemotron 3.5 Lightning 是一款拥有 300 亿参数的 MoE 模型 ,专为大型多智能体系统中的特定任务打造,助力开发更智能、更高效的智能体应用。 与同类其他模型相比,该模型可实现高达 4 倍的输出速度提升, 从而将智能体任务的整体完成速度加快 30% 。 Nemotron 3.5 Lightning 可以直接运行在本地 AI 系统上,包括 NVIDIA RTX PC、NVIDIA DGX Spark、NVIDIA DGX Station 以及 NVIDIA Jetson;也可面向企业级应用场景,无缝扩展至边缘 AI 设备、NVIDIA RTX PRO 工作站、数据中心及云端环境。 IT之家附开源链接: Hugging Face: https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 ModelScope: https://modelscope.ai/collections/nv-community/Nemotron-35-Lightning OpenRouter: https://openrouter.ai/nvidia/nemotron-3.5-lightning:free NVIDIA: https://build.nvidia.com/nvidia/nemotron-3.5-lightning-30b-a3b 相关阅读: 《 消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级 》 《 英伟达发布 Nemotron 3 Embed 系列 AI 模型,8B 版斩获 RTEB 榜首 》 《 英伟达发布 5500 亿参数 Nemotron 3 Ultra 开源模型,较同级别前沿模型推理速度最高提升 5 倍 》