#NVIDIA
市场传言 HBM 要凉,Counterpoint 直接反驳:NVIDIA Rubin 都在转向 12 层 HBM4,带宽容量优先于成本,高堆叠还会继续。
黑苹果装 N 卡的老大难有解了,NullMoth 开源的驱动连 RTX 50 系都能认,手上有闲置 N 卡的可以试试装 macOS。
The Information 挖出了黄仁勋女婿的履历:前职业滑雪运动员,进英伟达不到两年就升副总裁,管着 5000 亿美元规模的算力融资盘子。
AWS掌门人亲自谈AI泡沫,甩出2200亿CapEx和200万GPU订单这些硬数字,还讲了智能体时代的云怎么建,信息量很足。
如果你的 Agent 跑得慢、GPU 显存被 KV cache 吃满,这篇 NVIDIA Dynamo 的博客讲了 router 加 KV-cache manager 怎么复用上下文,值得照着调优。
CoreWeave 要去印度建算力了,和 AdaniConneX 合作,还要上 NVIDIA Vera Rubin,访谈里连一个机架多少钱都聊了。
NVIDIA 发现 RL 每步只改 1% 的权重,于是做了个只传差异的检查点同步方案,1T 模型从 87 分钟降到 150 秒,跑大规模 RL 的团队可以看看。
在柏林的朋友可以看看,Together AI 拉上 n8n 和 NVIDIA 聊怎么用开源模型做开发,还管饭。
一天里的关键更新都在这:Claude Haiku 5.5 带百万上下文还降价,GPT-6 全面推送交互式界面,GitHub Copilot CLI 能直接用本地 Ollama 模型。
新加坡电信的 RE:AI 拉上 SIT 和 NVIDIA 的联合中心,专门帮企业把 AI 试点变成能跑在生产线上的系统。
微软出了台 5999 美元的迷你主机,装了 128GB 内存和 RTX Spark N1X,系统预装 Copilot 和一堆开发工具,写 AI 代码开机就能用。
NVIDIA 这篇论文发现 Claude、Gemini、Qwen 这些模型一旦接上工具,挡有害请求的能力就掉最多近七成,做智能体安全评测的得看看。
Together AI 拉上 IBM 和 NVIDIA,在 IBM Cloud 上搭了套专用 B300 集群跑开源模型推理,企业部署开源模型又多一个选择。
NVIDIA 出了个 PivotOPD,专门解决智能体一开始走错就错到底的问题,让老师模型示范怎么纠偏,做 agent 的可以看看论文。
老黄难得登上微软发布会,聊了段 1995 年的旧事,讲清了 Windows、GeForce 和 CUDA 这条线的来龙去脉。
英伟达发布会说 RTX Spark 测了 1200 多款应用,DirectX 和 CUDA 程序都能本地跑,想搞本地 AI 的可以关注下。
Google DeepMind 把 SynthID 检测器开放给所有人了,能查 OpenAI、NVIDIA 等模型生成的内容,做内容鉴别的可以试试。
捷豹新车直接用 NVIDIA 的车规计算平台和安全系统,15 万项测试这个数字挺吓人,看看 AI 上车到底做到了什么程度。
Nous Research 拿到了 NVIDIA 等投资的 B 轮,主打 Hermes Agent,还要出手机 App,做开源模型的朋友可以关注下。
Google 把 SynthID Detector 开放给所有人了,能查内容是不是 Google、NVIDIA 这些家的 AI 生成的,Apple 支持也快来了,去 synthid.com 就能试。
微软这台 Surface Laptop Ultra 用 NVIDIA 的 Grace + Blackwell 芯片,128GB 统一内存能直接在笔记本上跑 1200 亿参数的本地模型,搞 AI 开发的可以盯一下。
做 RL 训练的朋友看下,CoreWeave 这个功能把换检查点的时间砍掉约 15 倍,Nemotron 实测 BrowseComp 涨了 8 个多点。
PyTorch 官方宣布的活动,Red Hat、NVIDIA、IBM 三家联合办,讲 vLLM、Ray 这些工具怎么进企业生产环境,搞部署的可以关注
Mistral 晒了训练 ML4 的家底:3800 块 Grace Blackwell,全在欧洲机房,后面还有 C 轮 D 轮集群要上线。
NVIDIA 拿 Nemotron 加 OpenShell 做了个电信排障智能体,没预案的故障它能自己查方案、先在仿真里试一遍再动手。
NVIDIA 调了电信行业的 AI 采用情况,去年 49% 在用 AI,今年涨到 66%,还提到开源模型很关键,做行业分析的可以看看数据。
NVIDIA 把开源模型改成懂电信网络的智能体,AT&T、SoftBank、Indosat 三家在用,Indosat 还适配了本地语言。