#NVIDIA

共 597 条 · 7 天 59 条 · 30 天 163 条 · 话题观测 →
6月12日
模型中美对照多源确认04:41
NVIDIA Nemotron 3 深度解析:混合 Mamba Transformer + 潜在 MoE + MTP

Nemotron 3 的架构创新直击大模型推理效率瓶颈,做模型优化和部署的开发者值得关注其混合 Mamba 和潜在 MoE 的具体实现,可以直接参考其设计思路。

事件专题
官方账号NVIDIA AI@NVIDIAAI11 个信源在谈原文
6月11日
6月10日
6月9日
6月8日
6月7日
6月6日
6月5日
模型中美对照官方一手83°05:48
NVIDIA 发布 Nemotron 3 Ultra:550B 混合专家模型,专为长时智能体设计

长时智能体开发者终于有了一个兼顾超长上下文和高推理效率的开放模型——Nemotron 3 Ultra 的 6 倍吞吐量提升能显著降低部署成本,做 Agent 或 RAG 系统的团队值得直接试。

事件专题
官方一手marktechpost@Asif Razzaq11 个信源在谈原文
6月4日