8月25日
07:35
8月24日
23:23
23:23lmarena.ai@lmarena_ai
精选78°
NVIDIA应用深度学习研究副总裁Bryan Catanzaro与Peter Gostev讨论了Nemotron模型家族的构建过程,以及NVIDIA加速开放模型发布的原因。讨论内容包括特殊教师模型在构建强大能力中的作用,训练后推理的挑战,开源模型的重要性,以及这一切对NVIDIA构建Nemotron的意义。
事件专题

推荐理由:想了解NVIDIA如何快速发布前沿开放模型?来看看Bryan Catanzaro和Peter Gostev的讨论,了解Nemotron模型家族的构建过程和开源模型的重要性。
21:36
21:36elvis@omarsar0
精选
NVIDIA新论文探讨评估智能体技能,提出Skill Lift方法,通过对比加载与未加载技能的执行差异来衡量技能提升。研究基于145个真实技能案例,发现技能执行、行为检查和技能效率方面有显著提升。
事件专题

推荐理由:NVIDIA提出Skill Lift新方法,评估智能体技能提升,与现有方法相比有显著优势,值得一读。
11:33
11:33IT之家博客/媒体
NVIDIA 考虑向 Perplexity AI 投资“数十亿美元”,双方正磋商交易,可能达成技术授权协议。Perplexity AI 计划以超过 300 亿美元的估值进行新一轮融资,年化营收规模从 2.5 亿美元增长至 7.5 亿美元以上。
事件专题

推荐理由:NVIDIA 考虑投资 Perplexity AI,估值高达 300 亿美元,营收增长迅速,值得关注。
01:19
01:19elvis@omarsar0
Jacob Peake分享一篇关于AI芯片架构的长篇博客,涵盖NVIDIA、AMD、TPU、Trainium、Cerebras、Groq等主要架构,分析架构、扩展(向上扩展和向外扩展)和软件堆栈,帮助理解架构及其权衡。
事件专题

推荐理由:想要了解AI芯片架构全景的朋友,强烈推荐阅读Jacob Peake的这篇博客,内容详实,对架构和权衡有深入分析。
8月23日
12:03
06:18
8月22日
01:34
01:34
01:08
01:08Jim Fan@DrJimFan
精选73°
T-Rex 是一种全新的机器人触觉探索方法,通过将触觉视为模型的第一公民,结合视觉和触觉专家进行实时运动规划与修正。同时,开源了最大的触觉数据集,并提供了训练方法。NVIDIA 和加州大学伯克利分校合作开发。
事件专题

推荐理由:T-Rex 是一种全新的机器人触觉探索方法,结合了视觉和触觉专家,能够实现更精准的运动规划。开源的数据集和训练方法,让更多人能够参与到机器人触觉研究中。
8月21日
21:38
16:18
14:13
04:02
8月20日
01:25
01:25官方账号NVIDIA AI@NVIDIAAI
74°
英伟达对超300项验证技能开展基准测试,以相同任务、模型和设置对比有无技能的代理表现。在多项真实任务基准中,带技能的代理正确率提升41个百分点。与无技能代理相比,带技能代理效率提升35个百分点。
事件专题

推荐理由:英伟达测试超300项技能,对比后可知技能对代理帮助大小, 和无技能代理比效果不同, 值得去了解。
8月19日
07:06
01:34
8月18日
06:13
06:13ollama@ollama
8月20日,Ollama在旧金山举办线下聚会,邀请NVIDIA、friendliai、OpenHandsDev的四位从业者展开对谈。讨论焦点是开源模型如何改变AI原生工程成本,以及编程助手投入生产的实际路径。活动包含观众问答和自由交流,名额有限,需通过Luma链接报名。
事件专题

推荐理由:Ollama这周四旧金山组了个局,NVIDIA和几家开源项目的工程师会聊编程助手落地,现场有问答和社交,想去的记得先RSVP。
02:15
02:15官方一手AWS Machine Learning Blog@Venu Kanamatareddy
精选
NVIDIA Nemotron 3.5 Lightning 已可在 Amazon SageMaker JumpStart 中部署。这是一款面向高并发智能体工作负载的开源模型,采用 30B 参数的 MoE 架构,其中活跃参数为 3B。该模型可提供最高 4 倍的吞吐量提升,以及最高 30% 更快的任务完成速度。开发者可通过 SageMaker JumpStart 一键启动部署。
事件专题

推荐理由:英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。
8月15日
12:33
12:33官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-27B是阿里开源模型,目前可在NVIDIA RTX Spark上本地运行。开发者能够直接下载、部署这款27B模型,并基于它构建应用。推文显示该模型在RTX Spark上运行流畅,为本地AI开发提供了新选择。
事件专题

推荐理由:阿里把Qwen3.8-27B开源了,还能在RTX Spark上本地跑,下载就能部署,不用走云端。
03:33
03:33官方账号NVIDIA AI@NVIDIAAI
71°
NVIDIA发布开源库NeMo Switchyard,用于智能体工作流中的模型路由。该库允许复杂推理和规划步骤调用前沿模型,高容量专门执行使用Nemotron Lightning。开发者可自定义路由策略,在成本和性能间灵活取舍。
事件专题

推荐理由:NVIDIA出了个开源的模型路由库Switchyard,能让工作流里复杂步骤用强模型、简单步骤用轻量模型,省成本。
8月13日
22:07
22:07官方账号NVIDIA AI@NVIDIAAI
精选77°
NVIDIA发布官方skills插件,Cursor智能体可调用300多项技能,覆盖CUDA、NeMo、RAG等30多个产品。开发者只需描述构建目标,插件会自动推荐并执行合适技能。该插件已上架Cursor marketplace,完整技能目录托管在GitHub。
事件专题

推荐理由:NVIDIA给Cursor出了个官方插件,装完你的智能体就会用CUDA和RAG这些技能了,搞开发更省事。
18:14
18:14官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。
事件专题

推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。
18:08
18:08官方账号Groq@GroqInc
精选
Groq 宣布成为 NVIDIA 云合作伙伴。公司称这是对现有客户体验的验证,即其 AI 基础设施运行达到最高标准。CEO Adam Winter 表示,推理正在成为 AI 中最大最关键的一层,Groq 打算比任何人都运行得更好。
事件专题

推荐理由:Groq 成了 NVIDIA 的云合作伙伴,等于推理基础设施拿到官方认证,CEO 还放话要跑赢所有人。
18:06
18:06官方账号NVIDIA AI@NVIDIAAI
精选71°
Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。
事件专题

推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。
18:04
18:04官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。
事件专题

推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。
18:02
18:02官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。
事件专题

推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
72°
英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。
事件专题

推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。