22:32官方一手Hugging Face: Blog(博客/媒体)NVIDIA 发布了 Nemotron 3.5 ASR 模型的微调指南,帮助开发者将通用语音识别模型适配到特定语言、专业领域或口音。该模型基于 Whisper 架构优化,支持低资源语言和噪声环境。指南提供了从数据准备、训练配置到部署的完整流程,并强调使用 LoRA 等高效微调方法降低计算成本。这对于需要高精度语音识别的垂直场景(如医疗、金融、客服)尤其有价值。AI模型语音识别ASRNemotron10 个信源在谈事件专题推荐理由:NVIDIA 把 ASR 微调的门槛降下来了,做语音应用的团队(尤其是非英语场景或专业领域)可以直接参考这套流程,省去大量试错成本。原文稍后读已读值得跟进有用关注 语音识别
22:10官方账号NVIDIA AI@NVIDIAAINVIDIA 宣布对 Ultra 模型进行后训练,使其适配 OpenClaw、NousResearch Hermes Agent 和 LangChain 等主流智能体框架。该模型作为开放前沿模型,开发者可针对不同领域定制专用智能体。此举降低了构建复杂 AI 智能体的门槛,推动开源生态发展。AI模型NVIDIAUltra智能体10 个信源在谈事件专题推荐理由:做智能体开发的团队终于有了官方适配主流框架的开放模型,可以直接基于 Ultra 定制领域专用智能体,省去大量底层适配工作,值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
22:09官方账号NVIDIA AI@NVIDIAAI76°NVIDIA 宣布完全开源 Nemotron 3 Ultra 模型,包括模型权重、合成数据和后训练配方。该模型已在 Hugging Face 上架,开发者可自由获取和使用。此举延续了 NVIDIA 在 AI 开源领域的承诺,为研究人员和开发者提供了完整的模型复现与定制能力。Nemotron 3 Ultra 的开放有助于推动大模型生态的透明度和可复现性。AI模型开源/仓库Nemotron 3 UltraNVIDIA10 个信源在谈事件专题推荐理由:NVIDIA 把 Nemotron 3 Ultra 的权重、数据和训练配方全部开源,做模型复现或定制训练的团队可以直接下载使用,省去从头训练的昂贵成本。原文稍后读已读值得跟进有用关注 开源/仓库
21:27官方账号NVIDIA AI@NVIDIAAI93°NVIDIA 今日正式推出 Nemotron 3 Ultra,一款 550B 参数的 MoE(混合专家)开源模型,专为长时间运行的智能体任务设计。相比其他开源前沿模型,该模型推理速度提升 5 倍,复杂智能体任务成本降低高达 30%。Nemotron 3 Ultra 旨在解决长周期 AI 任务中的效率与成本瓶颈,为开发者提供更经济、更快速的智能体部署方案。NVIDIA 强调其“前沿智能”级别性能,并保持开源,进一步推动 AI 生态发展。AI模型NVIDIANemotron 3 UltraMoE10 个信源在谈事件专题推荐理由:做智能体开发和部署的团队终于有了一个兼顾性能与成本的开源选择——Nemotron 3 Ultra 的 5 倍推理加速和 30% 成本降低值得直接上手测试。原文稍后读已读值得跟进有用关注 NVIDIA
20:32官方一手Hugging Face: Blog(博客/媒体)精选NVIDIA 提出了一种名为 Task-Seeded Synthetic Q&A Generation 的方法,用于为 Nemotron 模型预训练生成高质量的合成问答数据。该方法通过任务种子(task seeds)引导生成多样化的问答对,解决了传统数据生成中覆盖不足和多样性低的问题。实验表明,使用该方法生成的合成数据训练的模型在多个基准测试上表现优异,甚至优于使用真实数据训练的模型。这项技术有望降低对人工标注数据的依赖,加速大语言模型的开发。论文NVIDIANemotron合成数据10 个信源在谈事件专题推荐理由:NVIDIA 用任务种子生成合成数据,解决了预训练数据稀缺和多样性不足的问题,做 NLP 和模型训练的团队可以关注,能显著降低数据标注成本。原文稍后读已读值得跟进有用关注 NVIDIA
10:08官方一手pandaily@contact@pandaily.com (Pandaily)83°在NVIDIA GTC Taipei 2026上,一家中国具身智能公司宣布其模型在RoboArena基准测试中排名第一,超越了NVIDIA和Physical Intelligence等国际巨头。RoboArena是评估机器人自主决策和操作能力的权威基准,涵盖多种复杂任务。这一成就标志着中国在具身智能领域取得重大突破,展示了其技术实力和创新能力。该公司的模型在任务完成率、适应性和效率等关键指标上表现优异,为行业树立了新标杆。行业具身智能RoboArenaNVIDIA7 个信源在谈事件专题推荐理由:具身智能赛道迎来中国玩家登顶,做机器人或AI应用的团队值得关注——这不仅是技术突破,更可能改变行业竞争格局。原文稍后读已读值得跟进有用关注 具身智能
08:57IT之家(博客/媒体)精选微软 Surface RTX Spark Dev Box 是一款面向本地 AI 开发的紧凑型桌面设备,专为模型微调、本地推理和智能体工作流设计。该设备搭载 NVIDIA Grace CPU 和 Blackwell RTX GPU,拥有 128GB 统一内存,AI 算力高达 1 Petaflop,可本地运行 120B 参数模型。其铝制外壳覆盖约 1000 个散热孔,兼顾散热与结构设计,整机功耗仅 100W。系统预装开发者优化版 Windows 11 Pro,并配置了 VS Code、GitHub Copilot、WSL 2 等开发工具,旨在减少环境搭建时间。该设备将于今年晚些时候发售。AI产品微软Surface RTX Spark Dev BoxAI 开发机10 个信源在谈事件专题推荐理由:本地跑 120B 模型终于有正经硬件了——Surface RTX Spark Dev Box 把 AI 开发环境打包成 100W 的桌面盒子,做模型微调或智能体开发的团队可以直接关注,省去搭服务器和配环境的麻烦。原文稍后读已读值得跟进有用关注 微软
04:21Satya Nadella@satyanadella微软CEO Satya Nadella在Build大会上感谢NVIDIA CEO Jensen Huang的参与,强调双方在云端和边缘计算领域的深度合作。Jensen Huang从台北连线,展示了从Windows设备到AI工厂的全面合作,标志着智能体AI时代的到来。此次合作旨在推动AI基础设施的规模化部署,为开发者提供更强大的计算能力。行业微软NVIDIA智能体AI10 个信源在谈事件专题推荐理由:微软和NVIDIA联手推进智能体AI,从设备到云端全面覆盖,做AI基础设施和边缘计算的开发者值得关注这一合作动向。原文稍后读已读值得跟进有用关注 微软
01:04官方账号NVIDIA AI@NVIDIAAINVIDIA 发布了 OpenShell v0.0.55 版本,新增对 Google Vertex AI 推理提供者的支持,允许用户直接使用 Vertex AI 运行智能体。该版本还引入了基于配置文件的策略可见性,增强了网关中的 Podman 检测能力,并恢复了 GPU procfs 的基线行为。此外,修复了 CI 和文档问题,提升了整体稳定性和安全性。对于需要跨云部署 AI 智能体的开发者来说,这是一个实用的更新。AI产品OpenShellVertex AI智能体10 个信源在谈事件专题推荐理由:OpenShell 新增 Vertex AI 支持,让多云 AI 智能体部署更灵活,做跨平台推理的团队可以直接用起来。原文稍后读已读值得跟进有用关注 OpenShell
16:41官方一手marktechpost@Asif Razzaq83°NVIDIA 发布了 Cosmos 3,这是一款开源的“全模态世界模型”,采用双塔混合 Transformer 架构,将自回归 VLM 推理器与扩散生成器结合。该模型能够统一物理推理、世界生成和动作生成,为物理 AI 提供基础能力。Cosmos 3 旨在让机器人、自动驾驶等系统更好地理解物理世界并生成合理动作。其开源特性有望加速物理 AI 领域的研究与应用开发。AI模型NVIDIACosmos 3物理 AI10 个信源在谈事件专题推荐理由:NVIDIA 把物理推理和世界生成塞进一个开源模型,做机器人或自动驾驶的团队可以直接拿来用,省去从头训练物理世界模型的成本。原文稍后读已读值得跟进有用关注 NVIDIA
16:04Ate-a-Pi@svpinoNVIDIA和微软联合举办Builder's Arcade活动,这是一个为期5天的迷你项目(6月1日至5日),参与者可以免费构建并部署基于NVIDIA加速的Azure AI Foundry的智能体AI。活动旨在帮助开发者快速上手智能体开发,无需付费即可体验企业级AI基础设施。适合想尝试智能体AI但缺乏资源的个人开发者或团队。AI产品智能体NVIDIA微软10 个信源在谈事件专题推荐理由:想免费体验NVIDIA加速的智能体AI开发?这个5天活动直接给你企业级环境,做AI应用的开发者建议抓住机会,省去自己搭环境的成本。原文稍后读已读值得跟进有用关注 智能体
08:11官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 发布教程,展示如何让 AI 智能体学会一个工作流后,在每次重建后仍能记住。教程使用 NousResearch 的 Hermes Agent,结合 NVIDIA NemoClaw 和 OpenShell,将智能体连接到 Slack、Outlook、GitHub 和 NVIDIA 开发者论坛。用户可以通过对话纠正将新技能转化为可复用的技能,且私有数据受运行时策略保护。这意味着智能体可以跨部署持久化学习到的技能,无需每次重新训练。AI产品智能体工作流持久化NVIDIA10 个信源在谈事件专题推荐理由:做智能体开发和部署的团队终于可以解决「每次重建都要重新教」的痛点——NVIDIA 这套方案让技能跨部署持久化,直接连接 Slack、GitHub 等常用工具,值得一试。原文稍后读已读值得跟进有用关注 智能体
08:02官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 旗下 Nemotron Labs 发布了 Self-Evolving Hermes Agents,一种能够在使用中自我改进的企业级 AI 智能体。该智能体通过持续学习用户交互和反馈,自动优化自身行为,无需人工重新训练。这解决了传统企业 AI 部署后性能停滞的问题,显著降低了维护成本。Hermes Agents 基于 Nemotron 模型,专为复杂企业任务设计,如客户服务、流程自动化等。NVIDIA 在直播中展示了其在实际场景中的自适应能力,引发广泛关注。AI产品智能体企业AI自我进化10 个信源在谈事件专题推荐理由:企业 AI 终于能自己变强了——Self-Evolving Hermes Agents 解决了部署后性能衰减的痛点,做企业级 AI 落地的团队值得关注,看看它如何通过使用自动进化。原文稍后读已读值得跟进有用关注 智能体
05:59官方账号NVIDIA AI@NVIDIAAINVIDIA 宣布 DGX Spark 支持 NemoClaw 一键安装路径,用户只需一条命令即可完成模型获取、推理后端配置和运行时部署,大幅简化 AI Agent 的本地化部署流程。此前搭建 Agent 需要手动整合多个组件,耗时且依赖外部云服务。DGX Spark 通过提供可预测的本地算力,消除了对云端的依赖,适合需要长期运行、低延迟的 AI 应用场景。该更新让开发者能快速在本地启动 AI Agent,提升开发效率和部署灵活性。AI产品AI AgentNVIDIADGX Spark10 个信源在谈事件专题推荐理由:NVIDIA 把 AI Agent 的本地部署从繁琐的多步骤压缩成一条命令,做边缘计算或需要私有化部署的团队可以直接上手,省去云依赖和配置烦恼。原文稍后读已读值得跟进有用关注 AI Agent
02:53官方账号NVIDIA AI@NVIDIAAI78°NVIDIA 宣布推出 Cosmos 3,号称首个面向物理 AI 的全模态模型。该模型能够处理多种输入模态(如文本、图像、视频等),并应用于机器人、自动驾驶等物理世界场景。官方展示了多个令人惊叹的示例,体现了模型在理解与生成物理交互方面的能力。这标志着 AI 从数字世界向物理世界迈出了重要一步。AI模型物理AI全模态模型NVIDIA10 个信源在谈事件专题推荐理由:做机器人或自动驾驶的开发者终于有了一个能统一处理多模态输入的物理 AI 模型,值得看看它能带来哪些新可能。原文稍后读已读值得跟进有用关注 物理AI
01:03AI Will@FinanceYF5NVIDIA AI 官方宣布,新一代模型 Nemotron 3 Ultra 将于本周发布。该模型是 Nemotron 系列的升级版本,预计在性能和效率上将有显著提升。Nemotron 系列专注于为 AI 推理和训练提供高效解决方案,此次更新可能带来更强大的计算能力和更低的能耗。对于 AI 开发者和企业用户而言,这标志着 NVIDIA 在 AI 基础设施领域的持续创新。AI产品NVIDIANemotron 3 UltraAI 推理10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 系列是 AI 推理和训练的重要工具,新版本 Ultra 的发布将直接影响模型部署效率,做 AI 基础设施选型的团队值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
14:19ollama@ollamaOllama 宣布与 NVIDIA 合作,为 NVIDIA RTX Spark 超级芯片提供本地 AI 推理支持。RTX Spark 是一款 1 petaflop 的超级芯片,拥有完整的 CUDA 和 RTX 生态系统,并支持 Windows 原生智能体。这一合作将使得个人电脑能够运行更强大的本地 AI 模型,标志着个人计算的新起点。Ollama 用户将能够直接在 RTX Spark 上部署和运行 AI 模型,无需依赖云端。AI产品OllamaNVIDIARTX Spark10 个信源在谈事件专题推荐理由:Ollama 与 NVIDIA 联手,让本地 AI 推理性能跃升到 petaflop 级别,做本地模型部署的开发者可以直接在 RTX Spark 上跑模型,值得关注。原文稍后读已读值得跟进有用关注 Ollama
10:55官方账号NVIDIA AI@NVIDIAAINVIDIA AI与VSS(虚拟智能体系统)蓝图正被多家公司用于构建专用智能体,这些智能体可与中央工厂管理器通信,实现生产监控、质量提升和安全改进。参与公司包括DeepHow、Overview AI、Roboflow和Spingence。该方案通过智能体协作,将AI能力落地到工业场景,有望提升工厂运营效率。AI产品NVIDIAVSS蓝图智能体10 个信源在谈事件专题推荐理由:工业AI落地有了新范式——智能体协作监控工厂,做智能制造或工业自动化的团队值得关注这套蓝图。原文稍后读已读值得跟进有用关注 NVIDIA
10:45官方账号NVIDIA AI@NVIDIAAINVIDIA 在 Hugging Face 上开源仓库总数突破 1000 个(含 820 个模型、249 个数据集和 57 个 Spaces),粉丝接近 60,000。其 LocateAnything 模型成为 Hugging Face 当前第一热门模型,PiD 排名第五。NVIDIA 宣布采用 Linux 基金会的 OpenMDW 框架,并发布了 Cosmos 3(物理 AI 全模态世界模型)和 Alphamayo 2 Super(自动驾驶开源模型)。此外,Nemotron 3 即将发布,Nemotron 4 也在研发中。Hugging Face CEO Clement Delangue 称 NVIDIA 为“美国开源 AI 之王”,肯定了其对生态的贡献。行业NVIDIA开源/仓库Hugging Face10 个信源在谈事件专题推荐理由:NVIDIA 在 Hugging Face 上开源仓库破千,模型霸榜,做 AI 开发或模型选型的团队值得关注——这代表开源生态里又多了一个强力玩家,可以直接拿来用的资源又多了。原文稍后读已读值得跟进有用关注 NVIDIA
08:44官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 推出 Factory Operations Blueprint (FOX),这是一个用于构建工厂管理智能体的参考设计。该蓝图能够监控运营、实时推理数据并协调专业 AI 智能体,帮助大规模解决问题。早期采用者包括富士康、和硕、研华和纬创等,已在生产力、质量和效率方面取得显著提升。FOX 旨在为制造业提供统一的 AI 中枢,推动工业自动化进入新阶段。AI产品NVIDIA工厂运营AI 智能体10 个信源在谈事件专题推荐理由:制造业团队终于有了可落地的 AI 方案——FOX 直接解决工厂监控和协调的痛点,富士康等大厂已验证效果,做工业自动化的开发者值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
02:53官方账号Clement Delangue@ClementDelangueHugging Face CEO Clement Delangue 发推称赞 NVIDIA 是“美国开源 AI 之王”,指出 NVIDIA 在 Hugging Face 上已拥有超过 1000 个公开仓库(820 个模型、249 个数据集、57 个空间),粉丝近 6 万。当前 HF 上排名第一的热门模型是 LocateAnything,排名第五的是 PiD。NVIDIA 宣布采用 Linux 基金会的 OpenMDW 框架,并发布了 Cosmos 3(用于物理 AI 的全模态世界模型)、Alphamayo 2 Super(自动驾驶开源模型),以及即将推出 Nemotron 3 和正在开发中的 Nemotron 4。这些成果展示了 NVIDIA 在开源 AI 生态中的持续投入和领导力。行业NVIDIA开源模型Hugging Face10 个信源在谈事件专题推荐理由:NVIDIA 在开源 AI 上的投入远超多数人想象——1000 个公开仓库、多个前沿模型,做 AI 研究或开发的团队值得关注这些新资源,尤其是 Cosmos 3 和 Nemotron 系列。原文稍后读已读值得跟进有用关注 NVIDIA
17:51官方账号NVIDIA AI@NVIDIAAINVIDIA 展示了其 Cosmos 3 模型的图像转视频生成能力。用户输入一张从仪表盘视角拍摄的 F1 赛车图片,并提示“高速赛车在多个弯道中行驶”,模型生成了连贯且逼真的赛车视频。该演示强调了 Cosmos 3 在视频生成领域的进展,尤其擅长处理动态场景和复杂运动。这一技术有望在影视制作、自动驾驶仿真和游戏开发中发挥重要作用。AI产品NVIDIACosmos 3图像转视频10 个信源在谈事件专题推荐理由:NVIDIA 的 Cosmos 3 让图像转视频生成达到了新高度,做影视特效或自动驾驶仿真的团队值得关注,直接看效果比读论文更直观。原文稍后读已读值得跟进有用关注 NVIDIA
17:09Satya Nadella@satyanadella微软CEO萨提亚·纳德拉宣布,NVIDIA RTX Spark 是实现“为每个家庭和每张办公桌提供无计量智能”这一愿景的关键突破。他将在本周的Build大会上与黄仁勋(从台湾连线)分享更多细节。RTX Spark 是NVIDIA推出的AI推理加速平台,旨在将高性能AI能力带入Windows PC,让用户无需依赖云端即可运行复杂AI模型。此举标志着微软与NVIDIA在端侧AI领域的深度合作,有望加速AI PC的普及。AI产品微软NVIDIARTX Spark9 个信源在谈事件专题推荐理由:微软CEO亲自站台,RTX Spark 让Windows PC本地跑大模型成为可能,做AI应用开发或重度AI用户的值得关注Build大会的后续发布。原文稍后读已读值得跟进有用关注 微软
17:05Geek@geekbbNVIDIA 发布了名为 RTX Spark 的新超级芯片,专为个人 AI 计算设计。该芯片旨在让用户在本地运行 AI 模型,无需依赖云端。目前价格尚未公布,但网友反应热烈,纷纷表示价格将决定其市场接受度。RTX Spark 的推出标志着 NVIDIA 在个人 AI 硬件领域的进一步布局。AI产品NVIDIARTX Spark个人AI9 个信源在谈事件专题推荐理由:个人 AI 计算的门槛可能被 RTX Spark 拉低,做本地 AI 开发或重度推理的用户值得关注价格,这将决定你是否能低成本拥有专属 AI 算力。原文稍后读已读值得跟进有用关注 NVIDIA
15:07官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 宣布其 Cosmos 3 模型完全开源,包括模型权重和训练配方。该模型已在 Hugging Face 上发布,供开发者自由使用。此举延续了 NVIDIA 在 AI 领域开放生态的策略,旨在推动更多创新应用。Cosmos 3 的开放将加速研究者和工程师在视觉、语言等多模态任务上的探索。AI模型开源/仓库多模态模型NVIDIA9 个信源在谈事件专题推荐理由:NVIDIA 把 Cosmos 3 的权重和训练配方全开源了,做多模态研究的团队可以直接下载使用,省去从头训练的算力成本,值得点开看看。原文稍后读已读值得跟进有用关注 开源/仓库
15:06官方账号NVIDIA AI@NVIDIAAI精选NVIDIA AI 发布了一个基于数十亿跨模态样本训练的多模态预训练模型,旨在为开发者提供强大的基础模型,用于构建物理AI系统。该模型能显著减少所需的数据量和训练成本,使开发者能够更高效地开发机器人、自动驾驶等物理AI应用。NVIDIA 在技术博客中详细介绍了该模型的架构和性能优势。AI模型NVIDIA多模态模型预训练模型8 个信源在谈事件专题推荐理由:做物理AI(如机器人、自动驾驶)的开发者终于有了一个强大的预训练基础,能大幅降低数据收集和训练成本,建议直接查看技术博客了解细节。原文稍后读已读值得跟进有用关注 NVIDIA
15:05官方账号NVIDIA AI@NVIDIAAI93°NVIDIA 宣布推出 Cosmos 3,号称全球首个完全开放的全能模型,原生支持视觉推理、世界生成和动作生成。该模型提供 Super(32B)和 Nano(8B)两个版本,面向物理 AI 领域的研究与开发。Cosmos 3 的开源特性有望加速机器人、自动驾驶等物理世界交互系统的训练与部署,降低开发者门槛。AI模型物理AI开源/仓库视觉推理9 个信源在谈事件专题推荐理由:做机器人或自动驾驶的团队终于有了一个全开源的物理世界模型——Cosmos 3 原生支持视觉推理和动作生成,32B 和 8B 两个版本覆盖不同算力场景,值得直接上手试试。原文稍后读已读值得跟进有用关注 物理AI
14:33官方一手Hugging Face: Blog(博客/媒体)83°NVIDIA 发布了 Cosmos 3,这是首个开源的物理 AI 全能模型,能够同时进行推理和行动。该模型基于多模态输入(如视觉、语言)理解物理世界,并生成可执行的动作序列。Cosmos 3 在机器人、自动驾驶等需要物理交互的领域具有重大意义,因为它将感知、推理和行动整合在一个模型中。NVIDIA 在 Hugging Face 上开源了该模型,开发者可以直接使用或微调。AI模型物理 AI开源/仓库NVIDIA9 个信源在谈事件专题推荐理由:做机器人或自动驾驶的开发者终于有了一个开源的物理世界理解模型,能直接推理并生成动作,省去多模型拼接的麻烦,值得立即上手试试。原文稍后读已读值得跟进有用关注 物理 AI
14:08官方账号Runway ML@runwayml精选76°Runway 宣布作为创始成员加入 Cosmos Coalition,这是一个由 NVIDIA 和多家顶级 AI 实验室发起的全球性倡议,旨在共同构建并开源面向物理 AI 的前沿世界模型。该联盟将通过一个通用的开放生态系统,加速世界模型的研究与开发,推动物理 AI 的进步。此举有望降低物理 AI 的门槛,促进跨机构协作,为机器人、自动驾驶等领域提供基础模型。行业物理 AI世界模型开源/仓库10 个信源在谈事件专题推荐理由:物理 AI 开发者终于有了开放生态——Runway 和 NVIDIA 牵头开源世界模型,做机器人或自动驾驶的团队可以直接参与共建,值得关注。原文稍后读已读值得跟进有用关注 物理 AI
12:47官方账号NVIDIA AI@NVIDIAAINVIDIA 宣布推出 RTX Spark 超算芯片,专为个人 AI 计算设计。该芯片将强大的 AI 性能带入桌面端,让用户可以在本地运行复杂的 AI 模型和应用。RTX Spark 标志着个人 AI 计算进入新纪元,为开发者、研究人员和创作者提供了前所未有的本地 AI 算力。NVIDIA 表示将继续在原有频道上发布本地 AI 内容,但 RTX Spark 将成为新的焦点。AI产品NVIDIARTX Spark个人AI9 个信源在谈事件专题推荐理由:NVIDIA 把数据中心级的 AI 算力带到桌面,做本地 AI 开发、模型推理或内容创作的团队和个人可以直接受益,值得关注 RTX Spark 的后续细节。原文稍后读已读值得跟进有用关注 NVIDIA
12:35官方账号NVIDIA AI@NVIDIAAI精选NVIDIA AI 官方推特宣布,新一代大语言模型 Nemotron 3 Ultra 将于本周内推出。这是 Nemotron 系列的最新版本,具体参数和性能细节尚未披露。此前 Nemotron 4 340B 以推理基准上的表现受到关注,业界期待新版本能否进一步在效率和准确性上提升。AI模型Nemotron 3 UltraNVIDIA开源模型7 个信源在谈事件专题推荐理由:NVIDIA 终于要发新模型了原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
09:05IT之家(博客/媒体)精选76°戴尔向CoreWeave交付了全球首套可运行的NVIDIA Vera Rubin NVL72 AI超级计算机系统,并已通过所有测试。该系统基于戴尔PowerEdge XE9812液冷服务器,集成72个Rubin GPU和36颗Vera CPU,支持T级参数超大规模AI模型和MoE模型训练,同时在大规模AI推理中降低单位Token成本。CoreWeave计划从2026年下半年开始将基于Rubin的系统集成至其AI云平台。这标志着NVIDIA下一代AI计算架构首次落地实际部署,对超大规模AI训练和推理效率有重要影响。AI产品NVIDIAVera Rubin戴尔10 个信源在谈事件专题推荐理由:这是NVIDIA Rubin架构首次实际落地,做超大规模AI训练和推理的团队可以关注其单位Token成本降低的潜力,建议点开了解具体配置和部署时间线。原文稍后读已读值得跟进有用关注 NVIDIA
10:10官方账号NVIDIA AI@NVIDIAAINVIDIA AI 宣布 Arcee.ai 的 Trinity 模型将迁移至 OpenMDW-1.1 平台。这一迁移意味着 Trinity 模型将获得更好的性能优化和生态支持。OpenMDW-1.1 是 NVIDIA 推出的开放模型部署框架,旨在简化 AI 模型的部署和运行。此举进一步丰富了 OpenMDW 生态,为开发者提供了更多高质量模型选择。AI模型Arcee.aiTrinityOpenMDW-1.17 个信源在谈事件专题推荐理由:Arcee.ai 的 Trinity 模型迁移至 OpenMDW-1.1,意味着开发者可以更便捷地部署和运行该模型,做模型部署和推理优化的团队值得关注。原文稍后读已读值得跟进有用关注 Arcee.ai
01:52官方账号NVIDIA AI@NVIDIAAI精选DynoSim 是 NVIDIA 推出的工作负载驱动模拟工具,用于优化 Dynamo 推理服务栈的部署。它将 exhaustive 的部署搜索转化为 simulate-then-verify 循环,可在虚拟时间线上建模整个栈。团队能通过高保真模拟快速筛选数千种配置,然后仅在真实硬件上验证最佳候选。测试显示其模拟速度比真实时间快 1500 倍。技巧NVIDIADynoSimDynamo3 个信源在谈事件专题推荐理由:NVIDIA 搞了个模拟器,部署配置筛选快千倍原文稍后读已读值得跟进有用关注 NVIDIA
08:06Julien Chaumond@julien_cNVIDIA 发布了 DeepSeek-V4-Pro-NVFP4 的修复版本,该模型基于 DeepSeek-V4 架构,采用 NVFP4 精度优化,旨在提升推理效率和性能。修复版解决了之前版本中的一些问题,使模型更加稳定可靠。对于使用 NVIDIA 硬件进行 AI 推理的开发者来说,这是一个值得关注的更新。AI模型DeepSeek-V4NVIDIANVFP45 个信源在谈事件专题推荐理由:NVIDIA 官方修复版解决了 DeepSeek-V4 在自家硬件上的精度和稳定性问题,用 NVIDIA GPU 做推理的团队可以直接拉取使用,省去自己调优的麻烦。原文稍后读已读值得跟进有用关注 DeepSeek-V4
07:24官方一手marktechpost@Asif RazzaqNVIDIA 提出 X-Token,一种投影引导的跨分词器知识蒸馏(KD)方法,解决了 GOLD 方法中的两个结构性缺陷。在 Llama-3.2-1B 模型上,X-Token 将 GSM8k 准确率从 2.56% 提升至 15.54%,并在多个基准测试中平均超越 GOLD 3.82 分。该方法通过投影层对齐教师和学生模型的分词器,实现了更有效的知识迁移。X-Token 为小模型蒸馏大模型知识提供了新思路,尤其适用于资源受限场景。论文知识蒸馏NVIDIALlama-3.2-1B6 个信源在谈事件专题推荐理由:X-Token 解决了知识蒸馏中分词器不匹配的痛点,做模型压缩或边缘部署的团队可以直接用这个思路提升小模型推理能力,值得关注。原文稍后读已读值得跟进有用关注 知识蒸馏
06:09官方账号NVIDIA AI@NVIDIAAINVIDIA 发布了 Metropolis 视频搜索与摘要蓝图的智能体技能和模块化架构,允许开发者直接加载技能到兼容的编码智能体中,自动部署整个堆栈,无需手动配置多个微服务。用户可以通过自然语言对话界面,从数小时的视频中搜索、获取片段、摘要和答案,将视频转化为可搜索、可操作的情报。该更新大幅降低了视频分析的门槛,适用于安防、零售、工业监控等场景。AI产品NVIDIA视频搜索智能体5 个信源在谈事件专题推荐理由:做视频分析或监控系统的开发者,现在可以用自然语言直接检索数小时视频内容,省去手动配置微服务的麻烦,值得一试。原文稍后读已读值得跟进有用关注 NVIDIA
05:15官方账号NVIDIA AI@NVIDIAAINVIDIA AI 宣布,Harvey 与 Trajectory Labs 合作,基于 NVIDIA Nemotron 3 Super 模型进行后训练,专注于复杂法律任务。他们在 Harvey 的 Legal Agent Benchmark(LAB)上测试了 1200+ 端到端法律任务,覆盖 24 个业务领域。初始结果显示,后训练的 Nemotron 3 Super 在性能上可媲美闭源前沿模型。该项目强调开放权重、可审计性和数据主权,支持持续学习(continual learning),使法律智能体能够从反馈中不断改进。这标志着开放模型在专业领域应用的重要突破。AI模型NVIDIANemotron 3 Super法律 AI5 个信源在谈事件专题推荐理由:法律 AI 团队终于有了可审计、可定制的开放模型选择——Nemotron 3 Super 在复杂法律任务上追平闭源模型,做法律科技或合规自动化的开发者可以直接关注这个开源方案。原文稍后读已读值得跟进有用关注 NVIDIA
15:52IT之家(博客/媒体)精选戴尔在 COMPUTEX 2026 新闻资料袋中预告将推出基于 NVIDIA "N1X" 芯片的 XPS 机型,相关信息将于北京时间 6 月 1 日 11:00 解禁。此前联想 "N1X" 版 YOGA 360 16 已通过 3C 认证,两家 OEM 动作指向 NVIDIA 将在 COMPUTEX 2026 正式发布 "N1X" SoC。泄露信息显示 "N1X" 与 DGX Spark 的 GB10 同源,采用 20 核 Arm CPU + 6144 CUDA GPU 组合,支持 256-bit LPDDR5x 内存。AI产品N1XXPSDell5 个信源在谈事件专题推荐理由:戴尔XPS要上N1X芯片了原文稍后读已读值得跟进有用关注 N1X
14:33官方账号阶跃星辰 Stepfun@Stepfun_AI精选Step 3.7 Flash 模型在发布首日即获得 NVIDIA 的全面支持,包括 NIM 推理微服务、NeMo 框架以及 GPU 加速端点。这意味着开发者可以立即在 NVIDIA 的生态系统中部署和运行该模型,无需额外适配。NVIDIA 的首日支持通常意味着模型经过了优化,能充分利用 GPU 硬件性能,降低推理延迟和成本。这对于需要高性能推理的 AI 应用团队来说是一个重要信号,表明 Step 3.7 Flash 已具备企业级部署条件。AI模型Step 3.7 FlashNVIDIANIM5 个信源在谈事件专题推荐理由:NVIDIA 首日支持意味着 Step 3.7 Flash 可直接用于生产环境,做推理部署的团队可以省去适配工作,直接使用 NIM 和 NeMo 加速。原文稍后读已读值得跟进有用关注 Step 3.7 Flash