15:03IT之家(博客/媒体)精选72°英伟达使用 DeepSeek-v4-PRO 1.6T 模型在 Vera Rubin 服务器上测试,每兆瓦吞吐量达到 GB300 的 30 倍,每百万 Token 成本仅为 GB300 NVL72 的 35 分之一,大幅提升智能体运行效率。AI模型DeepSeek-V4-PRO英伟达Vera Rubin3 个信源在谈事件专题推荐理由:英伟达 DeepSeek-V4-PRO 模型在 Vera Rubin 服务器上表现出色,吞吐量大幅提升,值得关注。原文稍后读已读值得跟进有用关注 DeepSeek-V4-PRO
08:58IT之家(博客/媒体)精选72°英伟达宣布Groq 3 LPX机架全面量产,预计今年晚些时候上线。该机架集成500MB高速SRAM,由三星制造,英伟达GPU由台积电生产。Groq 3 LPX机架每秒可处理3400个Token,与Vera中央处理器和Rubin图形处理器一起部署在Nebius平台。行业英伟达Groq 3 LPX低延迟推理推荐理由:英伟达推出Groq 3 LPX机架,性能强大,适用于编程场景,与Vera Rubin和Rubin图形处理器协同工作,是低延迟推理领域的有力竞争者。原文稍后读已读值得跟进有用关注 英伟达
08:03IT之家(博客/媒体)72°SpaceX计划明年第四季度发射搭载英伟达芯片的AI卫星,预计2028年实现大规模部署。Vera Rubin NVL72系统针对太空环境优化,每个卫星数据中心比传统机架更简单、便宜、高密度。SpaceX已向FCC申请部署最多100万颗卫星,英伟达成为独家技术供应商。行业SpaceXAI卫星英伟达2 个信源在谈事件专题推荐理由:SpaceX明年将发射搭载英伟达芯片的AI卫星,比传统数据中心更高效,值得关注。原文稍后读已读值得跟进有用关注 SpaceX
17:05爱范儿@罗嘉阳英伟达将投资AI应用公司Perplexity,引发对其价值300亿美金的讨论。行业英伟达Perplexity投资推荐理由:英伟达投资Perplexity,关注AI应用新动态。原文稍后读已读值得跟进有用关注 英伟达
23:13IT之家(博客/媒体)Starcloud完成2.5亿美元A轮融资,研发GPU卫星,计划建太空数据中心;英伟达等投资,去年已送Starcloud-1卫星上太空,训练AI模型;Space-1 Vera Rubin模块开发中,未来将建8.8万颗卫星集群,提供20GW计算能力。行业StarcloudGPU卫星太空数据中心推荐理由:Starcloud获英伟达投资,研发GPU卫星,太空数据中心概念引人关注,未来计算能力惊人。原文稍后读已读值得跟进有用关注 Starcloud
18:49量子位@衡宇英伟达宣布AI服务器将涨价15%,导致1GW数据中心成本激增50亿美元。内存成本飙升是主要原因。行业英伟达AI服务器成本激增推荐理由:英伟达AI服务器涨价,看看数据中心成本如何变化,对比其他硬件价格。原文稍后读已读值得跟进有用关注 英伟达
16:14IT之家(博客/媒体)78°英伟达向Poolside支付60亿美元获取AI模型授权,并追加10亿美元投资,旨在开发与DeepSeek和Kimi K3竞争的AI模型。Poolside将保持独立运营,英伟达寻求加快AI技术渗透各行各业。行业英伟达PoolsideAI模型1 个信源在谈事件专题推荐理由:英伟达投资Poolside,助力打造中国开源AI竞争者,值得关注其未来发展。原文稍后读已读值得跟进有用关注 英伟达
15:34IT之家(博客/媒体)英伟达CEO黄仁勋两次签名的工作站GPU,RTX Pro 6000 Blackwell Workstation Edition,在RR Auction拍卖会上以57,450美元成交,远超估价。该显卡售价通常在1.2万至1.6万美元之间,主要面向AI开发等专业任务。行业英伟达RTX Pro 6000 Blackwell显卡拍卖推荐理由:想了解黄仁勋签名显卡拍卖情况的朋友,这块RTX Pro 6000 Blackwell显卡在拍卖会上以5.7万美元成交,远超估价,值得关注。原文稍后读已读值得跟进有用关注 英伟达
10:43IT之家(博客/媒体)《使命召唤:现代战争 4》测试版率先应用英伟达DLSS 4.5光线重建技术,提升画质。DLSS 4.5光线重建技术计划于本月发布,适用于所有GeForce RTX GPU。新版本编号为310.7.128,可通过替换DLL文件应用于其他游戏。DLSS 4.5光线重建采用第二代Transformer模型,参数量增加20%,计算能力提升35%。AI产品使命召唤:现代战争 4DLSS 4.5光线重建推荐理由:《使命召唤:现代战争 4》测试版率先应用DLSS 4.5,画质提升显著,是体验新技术的绝佳机会。原文稍后读已读值得跟进有用关注 使命召唤:现代战争 4
08:58IT之家(博客/媒体)78°英伟达AI芯片服务器因内存成本上涨,明年起涨价超15%,受影响产品包括搭载Vera Rubin和Grace Blackwell芯片的服务器。微软、谷歌等客户已被告知涨价消息。行业英伟达AI芯片服务器内存成本推荐理由:英伟达AI芯片服务器明年涨价,关注内存成本对AI基础设施的影响。原文稍后读已读值得跟进有用关注 英伟达
16:58IT之家(博客/媒体)英伟达否认了The Information关于其计划年底前向中国客户出货定制AI芯片的报道。该芯片原为Groq 3 LPU的衍生版本,旨在加速AI聊天机器人的响应速度。英伟达表示,目前在中国市场没有LPU销售,且产品路线图中没有针对中国市场的LPU产品。行业英伟达AI芯片Groq 3 LPU推荐理由:英伟达否认推出中国特供AI芯片,了解最新动态和行业走向。原文稍后读已读值得跟进有用关注 英伟达
15:29IT之家(博客/媒体)英伟达黄敏珊于8月19日现身2026世界机器人大会现场,参观越疆机器人展位;她重点观看“一脑多体”具身智能平台解决方案演示,展现英伟达与越疆在物理AI领域的合作成果;此前她在韩国访问LG电子后,第二天便来中国参与该大会,体现跨区域行业交流安排。行业黄敏珊英伟达2026世界机器人大会推荐理由:英伟达的黄敏珊来华参加2026世界机器人大会,去越疆展位看了物理AI合作项目,之前还去韩国见LG,这次来中国也有类似行业交流,想了解她活动的可以看看~原文稍后读已读值得跟进有用关注 黄敏珊
09:11IT之家(博客/媒体)英伟达尝试将使用其GPU的企业与北欧有能力部署这些GPU的数据中心运营商对接,推动当地数据中心交易升温。知情人士透露,英伟达借助‘牵线’方式助力北欧AI基础设施建设,2026年前后该地区预计新增数吉瓦数据中心容量。英伟达此举是为了拓展其在AI生态中的影响力,与北欧数据中心企业建立合作渠道。行业英伟达北欧数据中心推荐理由:英伟达帮有GPU的企业和北欧数据中心对接,这能促进当地交易,比之前更积极拓展生态呢。原文稍后读已读值得跟进有用关注 英伟达
07:06IT之家(博客/媒体)据美国银行数据,台积电亚利桑那工厂作为其美国最先进芯片生产线,2025年二季度营收占台积电总营收2%;该工厂为英伟达生产AI GPU,2025年一季度首次盈利后,对台积电利润贡献曾超3%;因高端封装集中在台湾,芯片需空运回岛封装,但二季度利润贡献短暂下降后回升;第二、三阶段计划用3纳米及更先进制程,当前二季度营收创新高但利润略降。行业台积电亚利桑那工厂美国银行推荐理由:美国银行发布了台积电亚利桑那工厂营收和盈利情况,能看出它在整体业务中和之前季度的不同表现。原文稍后读已读值得跟进有用关注 台积电
21:59IT之家(博客/媒体)83°英伟达CEO黄仁勋发文称,OpenAI已承诺在2030年前部署约12GW英伟达AI基础设施。若将PORTS-Pike合作从首期4.25GW扩大,总规模可增至约16GW。按此规模,到2030年英伟达算力对应业务机会约6000亿美元。双方在俄亥俄州PORTS-Pike科技园的首期合作将部署4.25GW容量,OpenAI将在此建设和运营AI工厂。行业OpenAI英伟达算力10 个信源在谈事件专题推荐理由:老黄说OpenAI承诺2030年前部署12GW英伟达算力,俄亥俄AI工厂首期4.25GW,总订单价值或达6000亿美元。原文稍后读已读值得跟进有用关注 OpenAI
13:13IT之家(博客/媒体)黑莓今年第一季度实现现金流转正,这是自2017年以来首次,股价过去一年上涨150%,市值约52亿美元。转型主要由QNX汽车操作系统和Secusmart加密软件驱动,其中QNX在2010年以约2亿美元收购,如今占黑莓营收大约一半。Secusmart于2014年被收购,目前为20个国家的政府提供北约级别的加密语音、短信和通讯服务。黑莓还扩大了与英伟达在物理AI领域的合作,将QNX应用于自动驾驶、人形机器人和手术机器人等方向。行业BlackBerryQNXSecusmart推荐理由:黑莓从手机厂变成汽车软件供应商,靠QNX活过来了,股价一年涨150%。想了解老牌厂商怎么转型的可以看。原文稍后读已读值得跟进有用关注 BlackBerry
11:42IT之家(博客/媒体)《连线》调查显示,加州近期接连发生两起AI数据中心硬件货运抢劫案,货物从硅谷运往南加州,涉事卡车至今下落不明。2026年第二季度美加货运盗窃损失同比翻倍至3.046亿美元,单起案件平均涉案金额达56.4万美元。窃贼采用追尾或PIT精准逼停战术,并冒用货运企业资质接单,调查人员认为卡车司机是内部同谋。英伟达DGX B300服务器美国售价约55万美元,黑市价格超过110万美元,而上市五年的A100价格已翻三倍。行业英伟达DGX B300A100推荐理由:加州劫匪专偷AI服务器,英伟达DGX B300黑市价超110万美元,官方才55万,连卡车司机都成了内应。原文稍后读已读值得跟进有用关注 英伟达
09:51IT之家(博客/媒体)76°英伟达正洽谈向软银旗下SB Energy投资至多30亿美元,用于OpenAI在俄亥俄州的数据中心项目。这笔投资是三方磋商的一部分,拟为该项目提供约1000亿美元信贷支持。出资分为两期:项目签约时支付15亿美元,剩余15亿美元在SB Energy启动IPO时投入。SB Energy计划最快下月上市,IPO募资规模至少50亿美元。另据《华尔街日报》,英伟达对OpenAI项目的担保规模已从此前磋商的2500亿美元下调至1200亿美元以内。行业英伟达OpenAISB Energy9 个信源在谈事件专题推荐理由:英伟达要掏30亿美元跟软银一起搞数据中心,还是给OpenAI的俄亥俄项目供钱,融资担保从2500亿降到1200亿,信息量不小。原文稍后读已读值得跟进有用关注 英伟达
07:35IT之家(博客/媒体)78°据《华尔街日报》报道,英伟达与OpenAI即将就俄亥俄州数据中心园区融资达成协议,英伟达担保规模从2500亿美元下调至不足1200亿美元。此前2500亿美元方案公布当日,英伟达股价下跌5%。项目规划总功率10吉瓦,一期5吉瓦由英伟达提供融资担保,OpenAI计划数日内签署10吉瓦容量约束性租约。软银旗下SB Energy负责开发,该数据中心建成后将是全球最大。英伟达还在洽谈为OpenAI芯片采购独立融资,总额或达3500亿美元。行业英伟达OpenAI软银8 个信源在谈事件专题推荐理由:英伟达给OpenAI数据中心的担保从2500亿砍到不到1200亿美元,怕风险了。项目还是全球最大,软银旗下开发,看后续。原文稍后读已读值得跟进有用关注 英伟达
07:23IT之家(博客/媒体)精选英伟达 Vera Rubin 平台量产提速带动 TLC NAND 现货市场收紧,512Gb 颗粒价格在 6 月跌破 21 美元后已回升至该价位。需求增长主要来自 Vera Rubin 的上下文内存扩展(CMX)技术,单台 2U CMX 服务器可搭载 600TB TLC 闪存,4 颗 BlueField-4 DPU 各管理 150TB 上下文内存。一个机柜组(pod)容量总计达 9.6PB,叠加企业级固态硬盘需求同步攀升,进一步挤压供应。英伟达当前多数 TLC NAND 已由长期合同锁定,但需求激增仍推高现货价格。美国银行同时辟谣 Vera Rubin Ultra 将减配 HBM 的传闻,称短期供应限制下的临时举措不会变为永久低容量产品。行业英伟达Vera RubinTLC NAND推荐理由:英伟达 Vera Rubin 量产太猛,把 TLC 闪存价格都抬回 21 美元了。想了解 AI 硬件怎么影响存储市场可以读读。原文稍后读已读值得跟进有用关注 英伟达
06:57IT之家(博客/媒体)82°英伟达宣布全面投产 Spectrum-X 以太网光子交换机,这是全球首款量产的 200G/lane 共封装光器件(CPO)交换机系统。该交换机面向大规模 AI 训练与推理集群,光学引擎与交换芯片封装在同一模块内,激光器数量降至此前方案的 1/4,功耗降至传统可插拔光模块方案的 1/5。SN6810 在 2U 机箱内配置 128 个 800Gb/s 端口,总交换能力 102.4Tb/s;SN6800 可提供 409.6Tb/s 交换能力,支持 512 个 800Gb/s 端口。台积电负责硅光子技术,富士康负责整机开发,目前已启动全面生产。AI产品Spectrum-X英伟达CPO推荐理由:英伟达的 Spectrum-X 光交换机正式投产了,全球首个 200G/lane CPO 方案,功耗只有以前的 1/5,搞 AI 集群组网的可以留意。原文稍后读已读值得跟进有用关注 Spectrum-X
20:18IT之家(博客/媒体)SK海力士2026上半年营业总收入131.90万亿韩元,同比增长230.8%,归母净利润134.15万亿韩元,同比增长788.16%。员工人均薪酬1.44亿韩元(约68.7万元人民币),同比增长23%;CEO郭鲁正半年总薪酬261亿韩元,其中奖金204.7亿韩元。研发支出达6.04万亿韩元,相当于去年全年90%,聚焦HBM4、321层NAND和DDR5。资本支出17.59万亿韩元,业界分析第一大客户为英伟达,约占营收13%。行业SK海力士HBM4英伟达推荐理由:想知道SK海力士多赚钱?员工上半年人均薪酬68.7万人民币,CEO拿了1.25亿,奖金还跟HBM4和321层NAND挂钩。原文稍后读已读值得跟进有用关注 SK海力士
00:27IT之家(博客/媒体)8月13日,英伟达宣布 GeForce NOW 原生 Linux 应用结束 Beta 测试,正式版支持 Ubuntu 24.04 及更新版本。新版新增官方 Flatpak 软件仓库,用户可通过 .bin 安装程序或 Flatpak 安装 com.nvidia.geforcenow 包。云端 DLSS 帧生成技术经优化,在 1440p 和 4K 分辨率下 60/120 FPS 串流时延迟更低。Performance 会员额外获得服务器端优化,部分高 CPU 需求游戏帧率提升,自动生效且不额外收费。本周 GFN Thursday 新增九款游戏,服务目前支持超过 2000 款 PC 游戏。AI产品GeForce NOW英伟达DLSS5 个信源在谈事件专题推荐理由:英伟达把 GeForce NOW Linux 客户端转正了,支持 Ubuntu 24.04 和 Flatpak,优化 DLSS 后云游戏延迟更低。原文稍后读已读值得跟进有用关注 GeForce NOW
18:03IT之家(博客/媒体)75°CoreWeave 首席财务官 Nitin Agrawal 表示,公司已签署合同将英伟达 A100 GPU 出租至 2029 年,该芯片发布于 2020 年。这一期限远超此前市场担心的两三年折旧周期,CoreWeave 称其老一代英伟达芯片资源已基本售罄,股价周三一度上涨 20%。GPU 租赁数据机构 Silicon Data 指出,A100 在 2026 年反弹后租赁价格依然保持良好,保修期通常为五年,损坏可直接更换。旧款芯片可转向推理等低要求任务,英伟达本周还宣布联合 Apollo、BlackRock 等机构,计划调动超过 5000 亿美元投入 AI 基础设施。行业CoreWeaveA100英伟达1 个信源在谈事件专题推荐理由:CoreWeave 用真合同证明 A100 能租到 2029 年,GPU 贬值焦虑可以放一放了。原文稍后读已读值得跟进有用关注 CoreWeave
17:57IT之家(博客/媒体)开源 AI API 网关 LiteLLM 于今年 3 月遭供应链投毒,攻击窗口仅约 40 分钟,波及全球约 2500 家企业。安全公司 CloudSEK 与 Hudson Rock 分析泄露文件发现,共约 195TB 数据被外传,包含 43.4 万条 CI/CD 流水线凭据。受影响机构包括英伟达、AWS、三星、思科、西门子、联发科等,覆盖云密钥、代码仓库 Token、SSH 密钥等敏感信息。官方称这是 2026 年最大规模的 AI 供应链泄露事件。行业LiteLLM英伟达供应链攻击推荐理由:LiteLLM 被投毒,40 分钟偷走 195TB 数据,英伟达、三星这些大厂都中招了,搞 AI 基础设施的都得看一眼。原文稍后读已读值得跟进有用关注 LiteLLM
21:19IT之家(博客/媒体)精选富士康母公司鸿海精密2026年第二季度营收约2.12万亿新台币,净利润599.7亿新台币,同比增长35%。云与网络产品首次占季度营收51%,智能消费电子占比降至29%。公司为英伟达Vera Rubin AI服务器机架准备量产,预计2026年Q3进入量产准备、Q4出货。富士康2026年计划资本支出提高30%,并在印度、墨西哥和美国得州扩大AI服务器生产。7月单月营收9465亿新台币,同比增长54.2%,创历史新高。行业富士康鸿海英伟达推荐理由:富士康AI服务器业务首次超过iPhone代工,占营收51%,还拿下英伟达Vera Rubin机架订单,想了解代工厂转型AI的可以看看。原文稍后读已读值得跟进有用关注 富士康
17:05IT之家(博客/媒体)马斯克在 SpaceX 全员会议上表示,AI 营收预计在 9 月超过公司其他所有业务总和,第四季度将大幅领先。SpaceX 将利用全体员工信息训练 Grok 大模型,员工被视为 AI 的"父母"。SpaceX 计划将数据中心部署到太空,完全采用英伟达 Vera Rubin 架构。公司 6 月上市后收购 xAI 并更名为 SpaceXAI,还以 600 亿美元收购了 AI 编程公司 Cursor。行业SpaceX马斯克Grok10 个信源在谈事件专题推荐理由:马斯克说下个月 AI 就能赚得比火箭还多,还打算用员工数据训 Grok,这操作够大胆,值得看看。原文稍后读已读值得跟进有用关注 SpaceX
09:55IT之家(博客/媒体)精选英伟达、思科和CrowdStrike等120多个组织组成的联盟提出为AI智能体制定事件报告框架SAFE。该框架要求成员披露智能体未经授权访问、泄露机密信息等事故,并保存提示、追踪、工具调用等证据。事故发生后需在4个工作日内提交初步报告,30天内发布事实报告,90天内提供补救更新。该计划以NASA航空安全报告系统为蓝本,旨在建立AI安全故障的标准报告方法。行业英伟达AI安全智能体推荐理由:英伟达牵头120多家组织搞了个AI事故报告标准,以后智能体闯祸得按规矩上报,想了解AI安全怎么管可以看看。原文稍后读已读值得跟进有用关注 英伟达
09:52IT之家(博客/媒体)英伟达于8月11日发布Nemotron 3.5 Lightning,这是一款拥有300亿参数的MoE开源模型,专为大型多智能体系统设计。相比同类模型,其输出速度最高提升4倍,智能体任务整体完成速度加快30%。该模型支持本地运行于NVIDIA RTX PC、DGX Spark等设备,也可扩展至企业级数据中心和云端环境。开源链接已提供在Hugging Face、ModelScope和OpenRouter等平台。AI模型Nemotron 3.5 Lightning英伟达开源模型10 个信源在谈事件专题推荐理由:英伟达新出的30B开源模型,跑智能体任务比同类快4倍,还能本地跑,搞多智能体开发的可以试试。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
08:59爱范儿@郑廷旭Manus宣布恢复独立运营,此前其与某公司合作引发争议。米哈游新作上线未满一月即宣布停运,创下最短运营纪录。胖东来为员工发放7万元委屈奖,引发社会关注。前千问负责人林俊旸创办新公司,腾讯参与支持。英伟达联手六家资管机构,为AI基础设施撬动超5000亿美元资本。DeepSeek招募IDC数据中心团队。行业Manus米哈游胖东来推荐理由:Manus独立运营、米哈游停运、胖东来委屈奖,三条热点一次看全,还有腾讯投新公司、英伟达5000亿大动作。原文稍后读已读值得跟进有用关注 Manus
22:58IT之家(博客/媒体)72°英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,据 The Information 援引项目参与者消息,其中最大模型预计至少拥有 1 万亿个参数。英伟达生成式 AI 副总裁 Kari Briski 表示,投资 Nemotron 是为了让每家企业、每个国家都能获得前沿开源模型。该模型最早可能在今年秋末准备就绪,但发布日期尚未确定。英伟达还发布了 Nemotron 3.5 Lightning 模型,面向代码审查、工具调用等任务,并推出开源模型路由库 NeMo Switchyard。AI模型Nemotron英伟达开源模型推荐理由:英伟达要出万亿参数开源模型了,直接对标全球顶级,想了解开源模型新格局的可以看看。原文稍后读已读值得跟进有用关注 Nemotron
16:30IT之家(博客/媒体)闲鱼平台出现多款改装版 RTX 4080 涡轮显卡,显存从 16GB 升级至 32GB GDDR6X,售价普遍超 1 万元。显存翻倍不改变 256-bit 位宽,也不提升带宽,但更适合模型训练。外媒 VideoCardz 报道,此前已有 48GB 版 RTX 4090 和 RTX 4090D,以及 RTX 4080 SUPER 32GB 显卡。这些魔改显卡可能需修改驱动,且无原厂保修,质量无保证。AI产品RTX 4080英伟达魔改显卡推荐理由:闲鱼上有人把 RTX 4080 显存翻倍到 32GB,卖一万多,适合跑模型但没保修,想捡漏得先想清楚。原文稍后读已读值得跟进有用关注 RTX 4080
12:33IT之家(博客/媒体)72°英伟达与阿波罗、黑石、贝莱德、博枫、高盛和KKR签署谅解备忘录,共同搭建融资平台,目标筹集超5000亿美元(约合3.38万亿元人民币)第三方资本,用于数据中心建设和英伟达硬件采购。黄仁勋称这是科技芯片首次成为可投资资产类别,强调GPU具有收入产生能力和较长使用周期。贝莱德CEO芬克将此举类比为20世纪70年代抵押贷款支持证券的诞生,认为将开启金融工程新方向。该计划旨在帮助超大规模云服务商和AI实验室获得资金,而不必完全依赖自身资产负债表。行业英伟达黄仁勋AI基础设施推荐理由:英伟达拉上黑石、高盛等6家巨头搞5000亿美元融资,要把GPU变成像房产一样能抵押的资产,黄仁勋亲自站台,AI基建的玩法要变了。原文稍后读已读值得跟进有用关注 英伟达
07:34IT之家(博客/媒体)博主 Zortos 与 dpadGuy 利用漏洞,以游戏《Trove》为入口,在 Steam 内置浏览器中安装 SalsaNOW 工具,从而进入 GeForce NOW 底层的完整 Windows 桌面。该桌面可运行 T3 编程环境和 LM Studio,并加载 Gemma 4 等本地 AI 模型。目前这一漏洞仅对付费版 GeForce NOW 会员生效,免费套餐和第三方合作伙伴运营的版本均不适用。限制包括浏览器下载功能受限、会话时长依然存在,关闭文件资源管理器等系统工具会直接结束整个云游戏会话。行业GeForce NOW英伟达云游戏推荐理由:Zortos 把 GeForce NOW 黑成了云电脑,能跑编程环境还加载 Gemma 4,但只有付费会员能玩。原文稍后读已读值得跟进有用关注 GeForce NOW
11:03IT之家(博客/媒体)82°据 The Information 消息,英伟达拟向电力基础设施开发商 Lancium 投资至多 30 亿美元,其中先期 20 亿美元换取约 20% 股权,后续可能追加 10 亿美元。Lancium 位于得克萨斯州阿比林的清洁园区是星际之门(Stargate)AI 数据中心首期所在地,该项目由软银、OpenAI 与甲骨文筹建,规划到 2029 年投入 5,000 亿美元。此次交易对 Lancium 及其电力资源资产估值约 100 亿美元,公司也在评估 2027 年 IPO。行业英伟达Lancium星际之门10 个信源在谈事件专题推荐理由:英伟达砸30亿美元买Lancium两成股份,给Stargate超算保供电。AI太耗电,巨头开始抢电力公司了。原文稍后读已读值得跟进有用关注 英伟达
12:50阮一峰的网络日志(博客/媒体)上月发布的开源模型 Kimi K3 性能略逊于美国顶尖模型,但美国企业对自行架设很感兴趣。美国政府放话考虑限制中国开源模型,理由是“违规”。微软、英伟达、思科等公司联合发表公开信《开放权重模型和美国 AI 领导力》反对限制。信中指出,开放生态比单一前沿模型更能决定人工智能领域的领导地位。行业Kimi K3开源模型微软10 个信源在谈事件专题推荐理由:这期周刊讲了美国政府想限制中国开源模型,结果微软英伟达先联名反对,背后的逻辑值得琢磨。原文稍后读已读值得跟进有用关注 Kimi K3
07:17IT之家(博客/媒体)英伟达在2026年黑帽大会上宣布开源cuFile API及其底层存储软件栈。cuFile是GPUDirect Storage技术的接口组件,2021年7月随CUDA Toolkit 11.4发布。该技术通过DMA让NVMe等存储设备直接向GPU传数据,绕过主内存中转,延迟可低至毫秒级。这能缓解AI推理中GPU因等待数据而闲置的“GPU饥饿”问题,也有助于RAG和智能体AI快速读取大型数据集。英伟达还发布了覆盖40家存储与闪存厂商的Storage-Next倡议。AI产品英伟达cuFileGPUDirect Storage推荐理由:英伟达把cuFile开源了,SSD能直接给GPU喂数据,游戏和AI推理都不容易卡了,搞存储的可以看看。原文稍后读已读值得跟进有用关注 英伟达
23:11IT之家(博客/媒体)据《商业内幕》8月6日报道,英伟达正在组建一支新的AI安全与网络安全工程团队。团队招聘岗位包括杰出工程师、安全研究工程师、评估工程师和高级经理,将对尚未部署的AI智能体进行安全评估。英伟达还计划开发用AI自动修复软件漏洞的工具。英伟达在招聘信息中称,开放权重模型、技术透明度和广泛科学审查是美国维持AI领先地位的基础。黄仁勋上月首次在X平台发文,转发了一封支持开放模型的公开信。行业英伟达AI安全开放权重模型推荐理由:英伟达也开始搞AI安全了,还公开挺开放权重模型,跟OpenAI的封闭路线唱对台戏,可以看看。原文稍后读已读值得跟进有用关注 英伟达
09:42IT之家(博客/媒体)英伟达正加速进入电信运营商市场,在中国寻找基站厂商开发符合海外要求的6G基站。深圳佳贤通信已确认合作,双方基于英伟达CUDA生态开发6G AI-RAN基站,合作已持续半年多。英伟达希望该6G项目在2027或2028年进入试验网。此前英伟达已投资10亿美元认购诺基亚约2.9%股份,并与诺基亚、爱立信等提出以AI原生平台建设6G。行业英伟达6G佳贤通信推荐理由:英伟达要找通信领域的“下一个中际旭创”了,已经和深圳佳贤通信合作搞6G AI-RAN基站,目标2028年前进试验网。原文稍后读已读值得跟进有用关注 英伟达
15:47量子位@听雨英伟达用了20年构建的CUDA生态,被AI用10小时撕开缺口。这一技术绕过了CUDA专有壁垒,将代码迁移到其他GPU平台的难度大幅降低。CUDA作为英伟达核心护城河的地位因此遭到动摇。AI模型CUDA英伟达GPU编程推荐理由:老黄攒了20年的CUDA家底,被一个AI用10小时挖穿了。以后换显卡跑模型,不用再手动改代码。原文稍后读已读值得跟进有用关注 CUDA