07:24IT之家(博客/媒体)英伟达开源推出 Nemotron 3 Embed 系列,包含 8B、1B 及 1B-NVFP4 三个版本,均支持商业使用。8B 版在 RTEB 基准上以 78.5% 得分排名第一,在 MMTEB 检索中得分 75.5%。该系列配备 32K 上下文窗口,专为 AI 智能体和 RAG 场景优化,可减少重复检索并降低 Token 消耗。1B 版通过蒸馏获得,1B-NVFP4 面向 Blackwell 架构优化,吞吐量最高提升 2 倍。AI模型Nemotron 3 Embed英伟达RTEB推荐理由:英伟达发了三个检索模型,8B 版直接登顶 RTEB 榜首,适合做 RAG 和智能体,还能省 token。原文稍后读已读值得跟进有用关注 Nemotron 3 Embed
04:24官方账号NVIDIA AI@NVIDIAAI71°NVIDIA发布Nemotron 3 Embed系列嵌入模型,8B版本在LMEB排行榜上位居第一,1B版本紧随其后排名第二。LMEB专门测试嵌入模型在长对话和记忆密集型任务中的检索能力,对需要跨会话保持上下文的智能体非常关键。此外,8B模型还以整体第一的成绩登顶RTEB基准,该基准评估真实世界场景下的检索准确性。AI模型NemotronNVIDIALMEB10 个信源在谈事件专题推荐理由:NVIDIA的Nemotron 3 Embed 8B在LMEB和RTEB两个排行榜都拿了第一,适合做智能体长期记忆的检索。原文稍后读已读值得跟进有用关注 Nemotron
15:57官方一手marktechpost@Asif Razzaq73°NVIDIA 于 2026 年 7 月 15-16 日发布 Nemotron 3 Embed 系列,包含三个开源检查点:8B-BF16、1B-BF16 和 1B-NVFP4。8B 模型在 RTEB 基准上以 78.46 平均 NDCG@10 排名第一。1B 模型通过 ModelOpt NAS 剪枝和 COS+MSE 蒸馏从 8B 教师模型获得。NVFP4 量化版本在 Blackwell 上吞吐量提升 2 倍,同时保留超过 99% 的 BF16 检索精度。所有检查点支持 32,768 token 输入,基于 OpenMDW-1.1 协议。AI模型Nemotron-3-EmbedNVIDIARTEB10 个信源在谈事件专题推荐理由:NVIDIA 开源了三个嵌入模型,8B 的 RTEB 第一,1B 的量化版速度翻倍还能保持 99% 精度,适合做检索和 RAG。原文稍后读已读值得跟进有用关注 Nemotron-3-Embed
00:41官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 发布了 Nemotron 3 Embed 8B 模型。该模型在 RTEB 基准测试中取得总体第一,RTEB 评估真实世界任务的检索准确度。更好的检索能力为智能体提供更相关的上下文,有助于提升响应准确性。AI模型Nemotron 3 Embed 8BNVIDIARTEB10 个信源在谈事件专题推荐理由:NVIDIA 新出的 8B 嵌入模型,RTEB 排名第一,检索能力强,适合做 RAG 和智能体。原文稍后读已读值得跟进有用关注 Nemotron 3 Embed 8B
00:38官方一手Hugging Face: Blog(博客/媒体)精选NVIDIA 发布 Nemotron 3 Embed 模型,在 RTEB 基准上以 68.7 的总体分排名第一。该模型在包含 8 个子任务的评测中,于对话检索、事实问答等场景均取得领先。其采用对比学习与多任务蒸馏技术,使检索准确率相比前代提升 12%。这为 RAG 和智能体系统提供了更强的基础检索能力。AI模型Nemotron 3 EmbedNVIDIARTEB10 个信源在谈事件专题推荐理由:NVIDIA 的新检索模型在 RTEB 上拿了第一,做智能体检索和 RAG 场景很能打,性能直接拉满。原文稍后读已读值得跟进有用关注 Nemotron 3 Embed