NVIDIA和LangChain搞的这个蓝图很实在,Nemotron 3 Ultra开放权重随便微调,智能体框架自带规划、工具、记忆,运行时也开源可审计。
#NVIDIA
NVIDIA 和 LangChain 搞了个开源智能体,用 Nemotron 3 Ultra 跑 Deep Agents,性能比肩闭源但成本只要 4 块多,比最接近的对手便宜 10 倍。搞 AI agent 的值得看看。
LangChain让Nemotron 3 Ultra跑分0.86,成本只要4.48刀,比对手便宜近10倍,性价比拉满。
LangChain 和 NVIDIA 搞了个开源的智能体参考架构,性能领先还便宜 10 倍成本,搞 agent 的可以看看。
LangChain和NVIDIA联手搞了个叫NemoClaw的开源代理系统,性能领先还便宜10倍以上,搞企业级AI代理的可以看看。
NVIDIA 和 d-Matrix 搞了个混合算力方案,GPU 负责预填充、专用芯片负责解码,推理 Token 生成速度翻了 10 倍。不是单纯的拼硬件,是真正分工优化。
NVIDIA发了个Colab友好教程,教你搭简化版Cosmos 3世界模型,用Omnimodal MoT架构实现跨模态预测,比跑全量模型省资源。
NVIDIA 刚开源的 75B MoE 模型,实际只激活 9.3B 参数,单卡就能跑百万 token 上下文,适合长文档或代码分析。
Perplexity CEO说他们用NVIDIA的Vera CPU跑智能体性能提升明显,Vera是专为agent设计的单线程王者CPU。
海韵官网泄露了NV三款SUPER显卡的功耗数据,RTX 5080 SUPER跑到415W,比非SUPER版高了55W,显存也升级到24GB,想买卡可以提前了解下功耗变化。
英伟达和 Hugging Face 把机器人基础模型和远程操作框架接入了开源库 LeRobot,还计划加入 Cosmos 3,海量数据集也能直接用。
NVIDIA在ICML 2026上刷了一波存在感:145篇论文用上Nemotron,74篇自家论文入选,还有2000篇靠NVIDIA GPU跑出来的。学术圈地位一览无余。
NVIDIA 搞了个新框架 ASPIRE,自己写程序自己修,LIBERO-Pro 长任务零样本就 31%,还能再提 77 点,做机器人的可以看看。
NVIDIA把30B模型劈成两半,并行写token,速度翻倍还保质量,不是新训模型是复用预训练,挺聪明的做法。
SGLang 和 NVIDIA 联手让 DeepSeek V4 在 Blackwell 上跑得快了 5 倍,开源推理引擎的效率又上了一个台阶。
英伟达下一代AI芯片Rubin Ultra从4颗die砍到2颗,性能减半,因为封装和散热太难搞了。和AMD MI500比可能不占优。
英伟达把 DeepSeek V4 的推理成本砍到五分之一,单 GPU 吞吐量暴增 20 倍,选 Blackwell 做推理的可以闭眼冲了。
NVIDIA的Nemotron现在接入了LangChain,你可以按需调优和部署智能体,不受厂商锁定,适合做定制化AI代理。
NVIDIA 开源了这个工具,让 AI 代理能直接调用分子模型做药物发现。用上它任务完成率翻倍还省 Token,做生物计算的同学可以试试。
想不依赖数据中心自己跑 550B 模型?NVIDIA 出了详细教程,四台 DGX Spark 就能拼出 OpenAI 兼容的端点。
想了解超大规模 AI 数据中心怎么建?Firmus 联手 NVIDIA 在印尼搞了个 360MW 的大项目,17 万颗 GPU,仅硬件收入就有 300 亿美元,值得一读。
想赢一台 DGX Spark 吗?用 Hermes Agent 造个自动赚钱的 AI 公司,前三名都有现金加硬件,截止 6 月 30 日,快上车。