15:57官方一手marktechpost@Asif Razzaq73°NVIDIA 于 2026 年 7 月 15-16 日发布 Nemotron 3 Embed 系列,包含三个开源检查点:8B-BF16、1B-BF16 和 1B-NVFP4。8B 模型在 RTEB 基准上以 78.46 平均 NDCG@10 排名第一。1B 模型通过 ModelOpt NAS 剪枝和 COS+MSE 蒸馏从 8B 教师模型获得。NVFP4 量化版本在 Blackwell 上吞吐量提升 2 倍,同时保留超过 99% 的 BF16 检索精度。所有检查点支持 32,768 token 输入,基于 OpenMDW-1.1 协议。AI模型Nemotron-3-EmbedNVIDIARTEB10 个信源在谈事件专题推荐理由:NVIDIA 开源了三个嵌入模型,8B 的 RTEB 第一,1B 的量化版速度翻倍还能保持 99% 精度,适合做检索和 RAG。原文稍后读已读值得跟进有用关注 Nemotron-3-Embed
01:18mem0@mem0ai精选Mem0在其记忆检索管线中评估了NVIDIA的Nemotron-3-Embed嵌入模型。在LongMemEval基准上,该模型的Recall@10从Qwen-3-600m的78.71提升至80.38。Nemotron-3-Embed具有开放权重,支持Blackwell上的NVFP4高效推理,且吞吐量高,适合频繁写入的系统。Mem0还详细介绍了其嵌入使用方式及评估过程。AI模型Nemotron-3-EmbedNVIDIAMem010 个信源在谈事件专题推荐理由:NVIDIA新嵌入模型Nemotron-3-Embed在检索任务上超越Qwen-3-600m,开放权重加NVFP4,适合做记忆系统。原文稍后读已读值得跟进有用关注 Nemotron-3-Embed