8月15日
03:33
03:33官方账号NVIDIA AI@NVIDIAAI
71°
NVIDIA发布开源库NeMo Switchyard,用于智能体工作流中的模型路由。该库允许复杂推理和规划步骤调用前沿模型,高容量专门执行使用Nemotron Lightning。开发者可自定义路由策略,在成本和性能间灵活取舍。
事件专题

推荐理由:NVIDIA出了个开源的模型路由库Switchyard,能让工作流里复杂步骤用强模型、简单步骤用轻量模型,省成本。
7月14日
13:55
13:55官方账号vLLM@vllm_project
精选
NVIDIA NeMo 团队发布了新的智能体优先强化学习框架 Molt,采用 vLLM(基于 Ray)作为 rollout 引擎。vLLM 支持快速异步服务,最高可扩展至 1T 级 MoE 规模,且易于集成,让上层的强化学习核心保持小巧和可修改。
事件专题

推荐理由:vLLM 被 NVIDIA 新框架 Molt 选为 rollout 主力,支持 1T 级 MoE 规模,想搞强化学习可以试试这套组合。
6月25日
00:51
00:51官方一手Hugging Face: Blog博客/媒体
精选
NVIDIA 发布 NeMo AutoModel,通过自动化模型并行、混合精度训练和梯度检查点,简化 Transformer 模型微调流程。该工具可自动检测硬件配置,支持多 GPU 分布式训练,无需手动调整参数。在微调 BERT-base 模型时,相比标准 PyTorch 实现,NeMo AutoModel 将训练时间缩短约 40%,并保持相同精度。
事件专题

推荐理由:NVIDIA 搞了个 NeMo AutoModel,能自动帮你加速微调 Transformer 模型,省去手动调参的麻烦,速度还快很多,适合想快速出结果的人。