01:19elvis@omarsar0Jacob Peake分享一篇关于AI芯片架构的长篇博客,涵盖NVIDIA、AMD、TPU、Trainium、Cerebras、Groq等主要架构,分析架构、扩展(向上扩展和向外扩展)和软件堆栈,帮助理解架构及其权衡。论文AI芯片架构NVIDIAAMD推荐理由:想要了解AI芯片架构全景的朋友,强烈推荐阅读Jacob Peake的这篇博客,内容详实,对架构和权衡有深入分析。原文稍后读已读值得跟进有用关注 AI芯片架构
01:13lmarena.ai@lmarena_aiNVIDIA应用深度学习研究副总裁@ctnzr将参与Arena Conversations新节目,探讨教师模型在构建强大能力中的作用、训练后推理挑战的增长、开源模型的重要性以及这对NVIDIA构建Nemotron的意义。节目将于8月24日早上9点(东部时间)/6点(太平洋时间)播出。行业NVIDIA教师模型开源模型4 个信源在谈事件专题推荐理由:想了解NVIDIA如何利用教师模型和开源模型构建Nemotron的读者,不要错过这场专家访谈!原文稍后读已读值得跟进有用关注 NVIDIA
12:03ollama@ollama72°PoolsideAI与NVIDIA工程师合作推出开放模型,旨在构建美国开放人工智能生态系统,与中美AI巨头竞争。行业PoolsideAINVIDIA开放模型6 个信源在谈事件专题推荐理由:PoolsideAI和NVIDIA合作推出开放模型,值得关注其未来发展。原文稍后读已读值得跟进有用关注 PoolsideAI
06:18官方账号Clement Delangue@ClementDelangue81°NVIDIA自建编码工具优化CUDA GPU内核,在ARC-AGI-3的25款游戏中全通关,实现183个关卡。将使AI模型和内核的运行、优化、后训练变得容易,预计将有1亿AI开发者。AI模型NVIDIACUDA优化3 个信源在谈事件专题推荐理由:NVIDIA优化CUDA内核,实现100%通关,让AI开发更简单,预计1亿开发者参与。原文稍后读已读值得跟进有用关注 NVIDIA
01:34官方账号NVIDIA AI@NVIDIAAI精选随着AI智能体承担更复杂任务,NVIDIA讨论了安全在智能体堆栈中的定位。指南控制智能体尝试做什么,基础设施控制它能做什么。AI安全和安全团队分享了他们的思考。AI模型AI安全智能体安全控制3 个信源在谈事件专题推荐理由:NVIDIA探讨了AI智能体安全定位,了解如何在智能体堆栈中实现安全控制。原文稍后读已读值得跟进有用关注 AI安全
01:34官方账号NVIDIA AI@NVIDIAAI精选78°NVIDIA 深入解析堆栈组件,从引导智能体行为的组件到确保其安全边界的基础设施。阅读详细分析:nvda.ws/4zyvjHm技巧NVIDIA智能体堆栈组件1 个信源在谈事件专题推荐理由:NVIDIA 深入解析堆栈组件,了解智能体行为引导和安全性保障。原文稍后读已读值得跟进有用关注 NVIDIA
01:08Jim Fan@DrJimFan精选73°T-Rex 是一种全新的机器人触觉探索方法,通过将触觉视为模型的第一公民,结合视觉和触觉专家进行实时运动规划与修正。同时,开源了最大的触觉数据集,并提供了训练方法。NVIDIA 和加州大学伯克利分校合作开发。AI模型触觉探索机器人触觉T-Rex3 个信源在谈事件专题推荐理由:T-Rex 是一种全新的机器人触觉探索方法,结合了视觉和触觉专家,能够实现更精准的运动规划。开源的数据集和训练方法,让更多人能够参与到机器人触觉研究中。原文稍后读已读值得跟进有用关注 触觉探索
21:38官方账号NVIDIA AI@NVIDIAAINVIDIA AVO通用编码智能体在ARC-AGI-3推理基准测试中满分,完成183个级别,无需指令或规则自主决策。AI模型NVIDIAARC-AGI-3智能体3 个信源在谈事件专题推荐理由:NVIDIA的通用编码智能体ARC-AGI-3测试满分,展示了强大的自主推理能力,是AI领域的又一里程碑!原文稍后读已读值得跟进有用关注 NVIDIA
16:18IT之家(博客/媒体)NVIDIA与韩国AI芯片企业Rebellions就潜在合作进行初步讨论,双方领导人会面探讨技术合作、投资或收购。Rebellions的Rebel100产品拥有2 PFLOPS FP8算力,523MB SRAM缓存和144GB HBM3E内存。行业NVIDIARebellionsAI芯片6 个信源在谈事件专题推荐理由:NVIDIA与Rebellions初步探讨合作,关注AI芯片技术合作动态,Rebel100性能值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
14:13官方账号Latent Space (swyx)(博客/媒体)Poolside公司获得120亿美元反向雇佣至NVIDIA,创始人获得10亿美元,员工获得60亿美元,Infraco扩展至70吉瓦新云服务行业PoolsideNVIDIA反向雇佣6 个信源在谈事件专题推荐理由:Poolside反向雇佣至NVIDIA,创始人及员工获得巨额回报,关注云计算扩展动态原文稍后读已读值得跟进有用关注 Poolside
04:02官方账号Greg Brockman@gdb81°OpenAI 宣布其首批 NVIDIA Vera Rubin 机架已到货并运行训练栈。这是扩展算力的重要一步。该算力将支持 OpenAI 下一代前沿 AI 模型的预训练。行业OpenAINVIDIAVera Rubin10 个信源在谈事件专题推荐理由:OpenAI 的首批 NVIDIA Vera Rubin 机架上线了,能支持下一代前沿 AI 模型训练,比之前的算力更强。原文稍后读已读值得跟进有用关注 OpenAI
01:25官方账号NVIDIA AI@NVIDIAAI74°英伟达对超300项验证技能开展基准测试,以相同任务、模型和设置对比有无技能的代理表现。在多项真实任务基准中,带技能的代理正确率提升41个百分点。与无技能代理相比,带技能代理效率提升35个百分点。AI模型NVIDIASkillsBenchmark7 个信源在谈事件专题推荐理由:英伟达测试超300项技能,对比后可知技能对代理帮助大小, 和无技能代理比效果不同, 值得去了解。原文稍后读已读值得跟进有用关注 NVIDIA
07:06官方一手OpenAI Blog(博客/媒体)NVIDIA团队使用ChatGPT Work减少手动任务,连接快速变化的信号,并在全球范围内扩展成功的工作流程。OpenAI官网介绍了这一案例,展示了ChatGPT Work在企业中的应用。NVIDIA通过该工具提升了工作效率,实现了知识共享和流程标准化。AI产品ChatGPT WorkNVIDIAOpenAI10 个信源在谈事件专题推荐理由:看看NVIDIA怎么用ChatGPT Work干活,减少重复劳动,还能把好流程推广到全球。原文稍后读已读值得跟进有用关注 ChatGPT Work
01:34官方账号NVIDIA AI@NVIDIAAI精选78°NVIDIA 发布了 TensorRT Model Connect 公测版。用户只需两个命令即可将 Hugging Face 模型转换为 TensorRT 推理格式。该工具无需中间 ONNX 导出,生成的包支持原生 C++ API。整个项目由 OpenAI Codex agents 构建,人类负责指导和审查工作。AI产品NVIDIATensorRTHugging Face10 个信源在谈事件专题推荐理由:NVIDIA 发了个工具,两行命令把 Hugging Face 模型转 TensorRT,省去 ONNX 导出步骤。原文稍后读已读值得跟进有用关注 NVIDIA
00:12官方账号NVIDIA AI@NVIDIAAINVIDIA AI 官方账号在 X 上发文,称今年夏天是开源 AI 的黄金时期,并询问网友最喜欢的开源发布。该推文引发讨论,目前已有 7 条回复、6 个点赞和 1547 次浏览。NVIDIA 近期在开源领域动作频繁,包括发布多个模型和工具。行业NVIDIA开源模型AI社区10 个信源在谈事件专题推荐理由:NVIDIA 官方在 X 上问大家最喜欢的开源发布,评论区有料,看看社区都在聊啥。原文稍后读已读值得跟进有用关注 NVIDIA
09:43IT之家(博客/媒体)Groq在8月17日宣布以35亿美元估值完成3.5亿美元A轮融资,由Disruptive领投,NVIDIA计划参与。此前的6月,Groq已获6.5亿美元融资,近期累计达10亿美元。去年12月,Groq与NVIDIA签署价值200亿美元的非独家技术许可协议,授权其LPU推理加速ASIC。本月12日,Groq成为NVIDIA云合作伙伴,将提供基于NVIDIA加速集群的训练和推理服务。其算力容量计划从当前的54MW提升至2027年的200+MW。行业GroqNVIDIANeocloud7 个信源在谈事件专题推荐理由:Groq从芯片厂转型做云服务,刚拿了3.5亿美元,NVIDIA也要参投,以后能用上它的LPU和NVIDIA集群算力。原文稍后读已读值得跟进有用关注 Groq
06:13ollama@ollama8月20日,Ollama在旧金山举办线下聚会,邀请NVIDIA、friendliai、OpenHandsDev的四位从业者展开对谈。讨论焦点是开源模型如何改变AI原生工程成本,以及编程助手投入生产的实际路径。活动包含观众问答和自由交流,名额有限,需通过Luma链接报名。行业OllamaNVIDIAfriendliai10 个信源在谈事件专题推荐理由:Ollama这周四旧金山组了个局,NVIDIA和几家开源项目的工程师会聊编程助手落地,现场有问答和社交,想去的记得先RSVP。原文稍后读已读值得跟进有用关注 Ollama
02:15官方一手AWS Machine Learning Blog@Venu Kanamatareddy精选NVIDIA Nemotron 3.5 Lightning 已可在 Amazon SageMaker JumpStart 中部署。这是一款面向高并发智能体工作负载的开源模型,采用 30B 参数的 MoE 架构,其中活跃参数为 3B。该模型可提供最高 4 倍的吞吐量提升,以及最高 30% 更快的任务完成速度。开发者可通过 SageMaker JumpStart 一键启动部署。AI模型Nemotron 3.5 LightningNVIDIASageMaker JumpStart5 个信源在谈事件专题推荐理由:英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
14:50IT之家(博客/媒体)精选TrendForce 预测,2026 年液冷散热在 AI 芯片中的渗透率将从 2025 年的约 33% 升至 53%。英伟达、AMD 的芯片方案已全面采用液冷技术。谷歌在云服务商中率先导入液冷,覆盖其 AI 服务器比例超过 80%。英伟达 Vera Rubin 平台将导入全液冷架构,散热范围扩大至 CX9 网卡、配电板等部件,AVC 预计第三季出货该平台水冷板模块。行业液冷散热TrendForceNVIDIA8 个信源在谈事件专题推荐理由:AI 服务器散热要转液冷了,明年渗透率过半,谷歌已经大面积用,英伟达新平台也全液冷,做散热件的 AVC 要出货了。原文稍后读已读值得跟进有用关注 液冷散热
18:44IT之家(博客/媒体)72°英伟达8月11日宣布与阿波罗、贝莱德、黑石、布鲁克菲尔德、高盛和KKR合作,建立独立融资平台,计划调动超5000亿美元第三方资本用于AI基础设施。黄仁勋称,部分AI基础设施投资项目可获最高25%的残值支持,以降低金融机构的资产融资风险。英伟达强调,该融资平台面向符合条件的AI实验室、企业和云服务商,金融机构将独立评估项目。英伟达以A100为例称,这款2020年推出的GPU到2026年仍用于AI训练、微调、推理和高性能计算,说明硬件可通过软件升级延长经济寿命。行业NVIDIAAI基础设施融资平台2 个信源在谈事件专题推荐理由:英伟达携手六家金融巨头要调动超5000亿美元建AI算力,还给项目最高25%残值补贴,这条讲清了钱怎么流转。原文稍后读已读值得跟进有用关注 NVIDIA
12:33官方账号阿里通义 Qwen@Alibaba_QwenQwen3.8-27B是阿里开源模型,目前可在NVIDIA RTX Spark上本地运行。开发者能够直接下载、部署这款27B模型,并基于它构建应用。推文显示该模型在RTX Spark上运行流畅,为本地AI开发提供了新选择。AI模型Qwen3.8-27BRTX SparkNVIDIA7 个信源在谈事件专题推荐理由:阿里把Qwen3.8-27B开源了,还能在RTX Spark上本地跑,下载就能部署,不用走云端。原文稍后读已读值得跟进有用关注 Qwen3.8-27B
03:33官方账号NVIDIA AI@NVIDIAAI71°NVIDIA发布开源库NeMo Switchyard,用于智能体工作流中的模型路由。该库允许复杂推理和规划步骤调用前沿模型,高容量专门执行使用Nemotron Lightning。开发者可自定义路由策略,在成本和性能间灵活取舍。AI产品NVIDIANeMoSwitchyard3 个信源在谈事件专题推荐理由:NVIDIA出了个开源的模型路由库Switchyard,能让工作流里复杂步骤用强模型、简单步骤用轻量模型,省成本。原文稍后读已读值得跟进有用关注 NVIDIA
14:12IT之家(博客/媒体)LG 与 NVIDIA 于当地时间 13 日在圣克拉拉签署谅解备忘录,双方 CEO 出席。LG 将在田纳西州洗衣机工厂验证轮式机器人 CLOiD,计划 2027 年第一季度推出基于 Jetson Thor 芯片和 Isaac GR00T 平台的双足人形机器人。LG 还计划 2027 年上半年建设基于 Vera Rubin 芯片的 NVIDIA DSX 架构 AI 工厂示范项目,并在 2028 年上半年建成 80MW AI 工厂。此外,LG 将开发集成自有车载软件的 NVIDIA DRIVE Hyperion 高性能计算平台。行业LGNVIDIA人形机器人3 个信源在谈事件专题推荐理由:LG 和英伟达正式签约了,要造双足机器人和 80MW 的 AI 工厂,还把芯片用到车上,值得看看细节。原文稍后读已读值得跟进有用关注 LG
22:07官方账号NVIDIA AI@NVIDIAAI精选77°NVIDIA发布官方skills插件,Cursor智能体可调用300多项技能,覆盖CUDA、NeMo、RAG等30多个产品。开发者只需描述构建目标,插件会自动推荐并执行合适技能。该插件已上架Cursor marketplace,完整技能目录托管在GitHub。AI产品NVIDIACursor智能体10 个信源在谈事件专题推荐理由:NVIDIA给Cursor出了个官方插件,装完你的智能体就会用CUDA和RAG这些技能了,搞开发更省事。原文稍后读已读值得跟进有用关注 NVIDIA
18:16官方账号NVIDIA AI@NVIDIAAI82°NVIDIA今日发布Nemotron 3.5,这是一款专为智能体AI系统中高吞吐量执行而设计的开源模型。Dream Security获得该模型的早期访问权限,其研究团队进行了监督微调、后训练、领域适配、网络安全推理和智能体工具使用等优化。该模型在Dream的内部网络安全基准测试中表现强劲,可帮助客户理解安全态势、调查风险并转化安全数据。相关发布博客已在开发者社区上线。AI模型NVIDIANemotron 3.5Dream Security10 个信源在谈事件专题推荐理由:NVIDIA出了新开源模型Nemotron 3.5,专为智能体场景打造,Dream Security抢先调教成了网络安全专用版,内部测试表现不错。原文稍后读已读值得跟进有用关注 NVIDIA
18:15官方账号NVIDIA AI@NVIDIAAI精选英伟达发布Nemotron 3.5 Lightning,一款30B参数的MoE模型,活跃参数仅3B。该模型由Nemotron 3 Ultra蒸馏而来,现已上线Fireworks平台。它在PinchBench上表现强劲,并在AA-Omniscience非幻觉测试中获得顶尖分数。模型专为高吞吐智能体工作流设计,强调可靠性与专精化。AI模型NemotronFireworksNVIDIA10 个信源在谈事件专题推荐理由:想做智能体又怕模型太贵太慢?Nemotron 3.5 Lightning只有3B活跃参数,在Fireworks上直接就能调。原文稍后读已读值得跟进有用关注 Nemotron
18:15官方账号NVIDIA AI@NVIDIAAI72°AgileRL 宣布与 NVIDIA 合作,支持 Nemotron 系列模型的后训练。NVIDIA 提前提供了 30B3A 参数 MoE 模型 Nemotron 3.5 Lightning。在 Arena 平台上,该模型经微调后在长程推理和真实客服任务上超过 Claude Sonnet 5。单次训练只需四块 H100 GPU 运行六小时即可掌握推理任务,上下文长度超过 50,000 token。Arena 客户可在 Nemotron 模型发布后立即获得相应的训练与评估环境。AI模型NemotronNVIDIAAgileRL10 个信源在谈事件专题推荐理由:AgileRL 把 Nemotron 3.5 Lightning 放到 Arena 上微调,6 小时就能超过 Claude Sonnet 5,训练完权重还归你。原文稍后读已读值得跟进有用关注 Nemotron
18:14官方账号NVIDIA AI@NVIDIAAI72°NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。AI模型NVIDIANemotron 3.5 LightningBaseten10 个信源在谈事件专题推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。原文稍后读已读值得跟进有用关注 NVIDIA
18:08官方账号Groq@GroqInc精选Groq 宣布成为 NVIDIA 云合作伙伴。公司称这是对现有客户体验的验证,即其 AI 基础设施运行达到最高标准。CEO Adam Winter 表示,推理正在成为 AI 中最大最关键的一层,Groq 打算比任何人都运行得更好。行业GroqNVIDIA推理服务3 个信源在谈事件专题推荐理由:Groq 成了 NVIDIA 的云合作伙伴,等于推理基础设施拿到官方认证,CEO 还放话要跑赢所有人。原文稍后读已读值得跟进有用关注 Groq
18:06官方账号NVIDIA AI@NVIDIAAI精选71°Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。AI模型Nemotron 3.5 LightningNVIDIAHarvey10 个信源在谈事件专题推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
18:04官方账号NVIDIA AI@NVIDIAAI精选NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。AI模型NVIDIANemotron 3.5 LightningTogether AI10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。原文稍后读已读值得跟进有用关注 NVIDIA
18:04官方账号NVIDIA AI@NVIDIAAI精选Reasonable 团队用 4B token 的合成 Verus 数据微调了 NVIDIA 最新开源模型 Nemotron 3.5 Lightning(30B)。微调后的模型在单次尝试通过率上超越了一个规模约 50 倍于它的模型,pass@3 则几乎持平。它的 token 生成速度也快于测试过的所有同尺寸开源模型。配套博客还分析了各模型在形式化证明中的失败方式、作弊行为,以及微调带来的影响。AI模型NemotronNVIDIAVerus10 个信源在谈事件专题推荐理由:Reasonable微调了NVIDIA的30B开源模型,形式化证明通过率胜过50倍大的模型,生成还更快。博客还拆解了模型怎么作弊。原文稍后读已读值得跟进有用关注 Nemotron
18:04官方账号NVIDIA AI@NVIDIAAIFastino Labs与NVIDIA合作发布两款开源模型Fastino-Nemotron-3.5-Lightning-Finance和Fastino-Nemotron-3.5-Lightning-Healthcare,均基于Nemotron 3.5 Lightning微调。金融模型在FinQA基准上执行准确率从15.86%提升至59.23%,增幅43.37个百分点;在BizFinBench上从49.65%升至57.46%。医疗模型在HealthAdminBench上从25.67%升至29.95%,在MedCalc-Bench上从49.09%升至54.18%。两款模型均以Apache 2.0许可发布在Hugging Face上。同时,Fastino还发布了自动微调工具Fastino Fine-Tuning Agent的私人预览版。AI模型FastinoNVIDIANemotron 3.510 个信源在谈事件专题推荐理由:Fastino跟NVIDIA合作,用自动微调Agent搞出了金融和医疗两个开源模型,FinQA涨了43个点,Apache 2.0随便用。原文稍后读已读值得跟进有用关注 Fastino
18:02官方账号NVIDIA AI@NVIDIAAI72°NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。AI模型NemotronNVIDIATinker10 个信源在谈事件专题推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。原文稍后读已读值得跟进有用关注 Nemotron
17:55官方账号NVIDIA AI@NVIDIAAI72°英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。AI模型Nemotron 3.5 LightningNVIDIADeepCogito10 个信源在谈事件专题推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:55官方账号NVIDIA AI@NVIDIAAIUniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。AI模型Nemotron 3.5 LightningNVIDIAGemma 410 个信源在谈事件专题推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:53官方账号NVIDIA AI@NVIDIAAI精选Trajectory 获得 NVIDIA Nemotron 3.5 Lightning 早期访问权,在 Harvey LAB 上完成后训练。该后训练在 Trajectory 平台一键完成,无需新工程。模型在一项测试中从 0% 提升到 8.3%,超过 Opus 4.6 的 6.6%。Trajectory 强调持续学习让小型模型可每晚、按客户反复训练,逼近按量计费的智能。AI模型NemotronNVIDIATrajectory10 个信源在谈事件专题推荐理由:Trajectory 一键后训练 Nemotron 3.5 Lightning,测试冲到 8.3% 超 Opus 4.6,小模型按客户定制能落地。原文稍后读已读值得跟进有用关注 Nemotron
17:45官方账号NVIDIA AI@NVIDIAAIApplied Compute 平台现已支持 NVIDIA 的 Nemotron 3.5 Lightning 进行训练和推理。该模型在 agentic coding benchmark 中,当并发和总 token 吞吐量扩展 16 倍时,解码吞吐量、首 token 时间和用户中位延迟保持不变。其 LatentMoE 和 Mamba 架构能以最小开销扩展稀疏性、上下文长度和批大小,显著提升后训练迭代吞吐量。AI产品Nemotron 3.5 LightningNVIDIAApplied Compute10 个信源在谈事件专题推荐理由:Applied Compute 支持 Nemotron 3.5 Lightning 了,并发翻 16 倍延迟不涨,训练迭代快多了。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:42官方账号NVIDIA AI@NVIDIAAI72°CrowdStrike 定制 NVIDIA Nemotron 3.5 Lightning,用于网络安全 agent 工作流。该模型达到分析师级准确率,训练速度更快、计算需求更低。它能自动关闭最高 88% 的良性检测,让安全团队专注真实威胁。AI模型Nemotron 3.5 LightningCrowdStrikeNVIDIA10 个信源在谈事件专题推荐理由:CrowdStrike 用 Nemotron 3.5 Lightning 做了安全智能体,自动关掉 88% 误报,训练快又省算力。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
07:20官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 发布全新 MoE 模型 Nemotron 3.5 Lightning。distil labs 作为欧洲发布合作伙伴,对其进行了微调。该团队将微调版与 4 个可比 MoE 模型在 6 项任务上对比,未微调时排名第三,微调后跃居第一。完整数值与失败场景已公布在 distil labs 博客上。AI模型Nemotron 3.5 LightningNVIDIAdistil labs10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 微调后,在 6 项任务上超过 4 个同类 MoE 模型拿了第一。想知道怎么调出来的,可以看这篇。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning