17:40IT之家(博客/媒体)英伟达推出全新融资模式,为AI云服务商GMI Cloud等提供担保,帮助其获得银行贷款采购GPU。GMI计划利用该模式投资5亿美元扩建AI基础设施。该模式中,若客户停止付款,英伟达承担风险并介入处理,作为交换分享收入分成。Fireworks AI本月完成15亿美元融资,估值达175亿美元。分析认为此举助英伟达拓展客户群,但也引发“循环融资”质疑。行业英伟达GPUAI云服务商推荐理由:英伟达用担保帮云厂商借钱买卡,自己赚分成又卖更多GPU,这招既聪明又有点冒险,适合关注AI基础设施融资的朋友看。原文稍后读已读值得跟进有用关注 英伟达
15:55IT之家(博客/媒体)精选英伟达发布合成视频检测器(SVD)服务,识别AI生成视频的准确率达92%。该服务整合到NIM微服务中,通过将视频拆分为504x504帧,交由Meta的DINOv2和DINOv3视觉变换器处理,每帧评分0到1。未经压缩视频准确率92%,15%压缩率下87%,50%压缩率下82%。处理速度方面,在RTX GPU上1080p视频仅需22毫秒。AI产品英伟达SVDNIM推荐理由:英伟达新出了SVD工具,能检测AI视频,最高92%准确率,在显卡上22毫秒跑完1080p视频。原文稍后读已读值得跟进有用关注 英伟达
15:37IT之家(博客/媒体)Noetra是一家由日本政府支持的Physical AI与机器人基础模型公司。该公司第一年获得超3800亿日元政府资金,并有软银、本田、索尼等44家企业参与支持。Noetra计划采购2.75万颗英伟达Rubin AI芯片,基础设施将于2028年6月投入运营。CEO丹波弘伸表示这是日本提升AI技术自主能力的最后机会。日本政府目标到2040年部署1000万台AI机器人。行业Noetra英伟达Rubin推荐理由:Noetra拿到日本政府3800亿日元支持,拉上软银、本田等44家企业,要买2.75万颗英伟达Rubin芯片做物理AI和机器人基础模型。说是日本AI自主的最后一搏,值得关注。原文稍后读已读值得跟进有用关注 Noetra
14:24IT之家(博客/媒体)82°英伟达宣布其 Blackwell GB300 在 256 块 GPU 上预训练 DeepSeek-v3 671B 模型,每 GPU 算力达到 1648 TFLOPs,刷新 MoE 预训练世界纪录。相比 2025 年 11 月的 1088 TFLOPs,性能优化提升 50%。与上一代 GB200 的 606 TFLOPs 相比,GB300 实现了约 3 倍性能跃升。英伟达通过模拟超过 25 万种配置,发现 38 项优化方案,累计进行 140 万小时 GPU 优化测试。AI模型DeepSeek-v3英伟达Blackwell推荐理由:英伟达用 Blackwell GB300 跑 DeepSeek-v3,每 GPU 1648 TFLOPs,比上一代快 3 倍,技术优化真猛。原文稍后读已读值得跟进有用关注 DeepSeek-v3
14:07IT之家(博客/媒体)76°英伟达7月22日发布Rubin GPU架构细节,该GPU基于台积电3nm工艺,集成3360亿个晶体管。智能体AI工作负载的单位能耗吞吐量是Blackwell的10倍,提升源自增强型Tensor Core、HBM4内存和第三代Transformer引擎。Rubin搭载8个HBM4堆栈,总容量288GB,峰值带宽22TB/s,较Blackwell的8TB/s提升1.8倍。架构由两块Die通过NV-HBI连接,包含224个SM和896个Tensor Cores,NVLink 6提供3600GB/s互联带宽。AI模型RubinBlackwell英伟达推荐理由:英伟达新Rubin GPU细节揭秘,晶体管比Blackwell多62%,智能体AI性能翻10倍,搞AI芯片的必看。原文稍后读已读值得跟进有用关注 Rubin
09:48IT之家(博客/媒体)英伟达在 SIGGRAPH 2025 上展示了 DLSS 5 的开发者控制能力,开发者可按场景在 Model A、Model B、Model C 三种模型间实时切换,三者训练参数不同导致皮肤、织物与光照外观差异。全局控制包含 Structure Intensity 和 Tone Intensity 两个滑块,分别调节高频细节和低频光照。英伟达解决了三个挑战:保持原始创意愿景、实现基于运动矢量的时序流、在 16ms 内渲染 830 万像素 4K 帧。AI模型DLSS 5英伟达SIGGRAPH推荐理由:英伟达在 SIGGRAPH 上展示了 DLSS 5 新细节,三种模型可实时切换,还能精细调角色和场景,游戏画质控制更强了。原文稍后读已读值得跟进有用关注 DLSS 5
09:30IT之家(博客/媒体)韩媒报道三星向英伟达供应超过60%的V-NAND产能。英伟达CMX存贮方案搭载576块SSD,总容量9600TB。预计2026年CMX所需NAND达3500万TB,2027年超1亿TB。三星V9(286层)占产能60%,良率超80%;V10密度比V9提高50%,V11可达500层。行业三星英伟达V-NAND推荐理由:三星把六成闪存产能都给了英伟达,V9已稳定,V10密度再提50%,这波存储布局看懂AI服务器需求。原文稍后读已读值得跟进有用关注 三星
09:03IT之家(博客/媒体)韩联社7月22日报道,三星电子会长李在镕、SK集团会长崔泰源、NAVER董事会主席李海珍将于7月24日在硅谷附近与英伟达CEO黄仁勋举行圆桌对话。OpenAI CEO萨姆·奥尔特曼和Anthropic CEO达里奥·阿莫迪也可能出席。黄仁勋今年6月曾访韩,并宣布英伟达已着手在韩新建AI技术中心项目。行业三星SK集团NAVER10 个信源在谈事件专题推荐理由:三星、SK、NAVER掌门人要在硅谷和英伟达黄仁勋开圆桌会,OpenAI和Anthropic老大也可能来,AI巨头又聚首了。原文稍后读已读值得跟进有用关注 三星
07:48IT之家(博客/媒体)82°英伟达发布Spectrum-6交换系统,带宽达102.4Tbps,容量较上一代提升2倍。该系统面向Vera Rubin平台,已进入全球超大规模AI工厂。首批采用者包括CoreWeave、Microsoft、Nebius、SpaceXAI和Tesla。CoreWeave将部署基于Vera Rubin和Spectrum-6的基础设施以加速模型训练和推理。AI产品Spectrum-6Vera Rubin英伟达推荐理由:英伟达新交换机带宽102.4Tbps,比上代快2倍,已给微软、特斯拉用了,训练推理更快。原文稍后读已读值得跟进有用关注 Spectrum-6
15:52IT之家(博客/媒体)百时美施贵宝(BMS)宣布采购基于英伟达 Vera Rubin 架构的 DGX SuperPOD,成为生命科学行业首家部署该系统的企业。此前 BMS 已有较小规模 DGX SuperPOD 系统,Vera Rubin 版本领先约两到三个产品世代。BMS 已利用 AI 将临床试验药物制备时间缩短 20%-30%,预计未来可扩大至 50%。其一款早期临床的镰状细胞病疗法在无 AI 辅助下可能不会被发现。新系统每瓦电力可提供约 10 倍于旧系统的计算能力。行业英伟达Vera RubinDGX SuperPOD推荐理由:BMS 买了英伟达最新 Vera Rubin 超算,能把候选药物测试量从 10 个提升到几十个,还省电。做药快三成,想了解 AI 制药怎么落地的可以看看。原文稍后读已读值得跟进有用关注 英伟达
15:39IT之家(博客/媒体)英伟达发布合成视频检测器 NIM,可逐帧分析视频并给出 AI 生成内容的分类评分。内部测试显示,对无压缩视频准确率达 92%,15% 压缩率下为 85%,50% 压缩率下仍达 82%。在 RTX GPU 上处理 1080P 视频最快 22 毫秒,在企业级 L40 GPU 上约 30 毫秒。面向媒体、新闻编辑室和个人用户提供。AI产品NIM英伟达RTX GPU推荐理由:英伟达出了个检测AI视频的工具,逐帧分析,最高92%准确率,连压缩过的视频都能识别,适合媒体和内容审核用。原文稍后读已读值得跟进有用关注 NIM
08:09IT之家(博客/媒体)精选73°Wolfe Research报告披露,英伟达正在美国大规模收购暗光纤,潜在容量约7.6 Pb/s,基于100对光纤、每根80-96个波长通道、每通道800Gbps估算。Needham分析师预计该项目未来三年投资50-100亿美元。英伟达可能借此减少对亚马逊AWS、微软Azure等云服务商依赖,支持AI数据中心互联。光通信企业Ciena被视为潜在受益方。行业英伟达暗光纤AI基础设施推荐理由:英伟达砸重金买暗光纤,7.6 Pb/s的带宽专门给AI数据中心互联,想自建网络摆脱云巨头,值得关注。原文稍后读已读值得跟进有用关注 英伟达
14:51IT之家(博客/媒体)73°台积电宣布追加1000亿美元投资扩建美国亚利桑那州工厂,总投资额升至2650亿美元。CFO黄仁昭表示AI芯片需求具有多年结构性特征,并称第一座晶圆厂良率已与台湾旗舰厂相当。第二座晶圆厂即将设备进驻,第四座及先进封装厂前期工作已启动。公司同时计划在台湾新建13座工厂。尽管第二季度业绩创纪录,台积电股价周五仍下跌7.3%,但年内累计涨幅近50%。行业台积电英伟达AI芯片推荐理由:台积电砸千亿美元扩建美国厂,AI芯片需求强劲,良率已超预期。竞争对手三星、英特尔紧追,看点十足。原文稍后读已读值得跟进有用关注 台积电
09:36IT之家(博客/媒体)鸿海首次拿下 SpaceX AI 服务器代工订单,涉及超过 1.3 万个英伟达 GB300 机柜,单机柜 400 万美元,总金额达 520 亿美元。SpaceX 的 Colossus 1 数据中心已部署超 22 万颗英伟达 GPU,Colossus 2 数据中心拥有超 55 万颗 GPU,以 GB200 和 GB300 为主。鸿海预计今年四季度交付,打破戴尔和超微对 AI 服务器的长期垄断。行业SpaceX鸿海英伟达推荐理由:鸿海接了个大单,帮 SpaceX 造 GB300 服务器,一共 520 亿美元,年底交货,直接挑战戴尔和超微的地位。原文稍后读已读值得跟进有用关注 SpaceX
21:52量子位@Jay奇异摩尔在WAIC 2026上首次亮相其国产GPU直通方案。该方案无需依赖英伟达网卡,实现GPU直接通信。实测数据显示,吞吐量大幅提升,延迟降低近一半。AI产品奇异摩尔英伟达GPU直通推荐理由:奇异摩尔在WAIC拿出了不靠英伟达网卡的GPU直通方案,实测吞吐大涨延迟砍半,国产方案真能打了。原文稍后读已读值得跟进有用关注 奇异摩尔
07:57IT之家(博客/媒体)英伟达 CEO 黄仁勋在东京宣布与 Noetra 公司合作,建设配备 2.75 万块 GPU 的 AI 工厂。该项目被定位为全球首个面向机器人产业的国家级 AI 基础设施,旨在为日本机器人产业提供大规模算力支持。Noetra 由软银、NEC、索尼和本田等企业共同成立,并获得日本政府支持。黄仁勋还在居酒屋与多家日企高层会面,并向粉丝分发红豆糕。行业英伟达黄仁勋Noetra推荐理由:英伟达在日本搞了个大项目,2.75万块GPU专门给机器人用,还顺便送了红豆糕,挺有意思。原文稍后读已读值得跟进有用关注 英伟达
23:30IT之家(博客/媒体)73°英伟达发布了专为 RTX Spark PC 定制的 Windows 11 Arm64 驱动程序,版本号为 616.00。驱动文件确认了两款 RTX Spark N1X GPU 配置,分别搭载 6144 和 5120 个 Blackwell RTX 核心。该平台采用 Arm CPU 结合 Blackwell GPU,最高提供 20 个 CPU 核心和 128GB 统一内存。微软已为 RTX Spark 优化 Windows 11 调度器,并计划通过 MPTF 框架管理功耗。首批产品预计 2026 年秋季上市,包括微软、华硕、戴尔等品牌的笔记本和迷你主机。AI模型RTX SparkN1XBlackwell推荐理由:英伟达的 RTX Spark 驱动曝光了 6144 核心猛兽,Arm Windows PC 要变天了,微软还专门改了调度器,等等党的新目标来了。原文稍后读已读值得跟进有用关注 RTX Spark
07:24IT之家(博客/媒体)英伟达开源推出 Nemotron 3 Embed 系列,包含 8B、1B 及 1B-NVFP4 三个版本,均支持商业使用。8B 版在 RTEB 基准上以 78.5% 得分排名第一,在 MMTEB 检索中得分 75.5%。该系列配备 32K 上下文窗口,专为 AI 智能体和 RAG 场景优化,可减少重复检索并降低 Token 消耗。1B 版通过蒸馏获得,1B-NVFP4 面向 Blackwell 架构优化,吞吐量最高提升 2 倍。AI模型Nemotron 3 Embed英伟达RTEB推荐理由:英伟达发了三个检索模型,8B 版直接登顶 RTEB 榜首,适合做 RAG 和智能体,还能省 token。原文稍后读已读值得跟进有用关注 Nemotron 3 Embed
03:31量子位@思邈在WAIC 2026上,多位业内人士分享了关于国产AI芯片竞争格局的新判断。真正的对手不是英伟达GPU,而是软件生态和场景落地的挑战。芯片厂商需要更关注实际应用需求而非单纯比拼算力参数。行业国产AI芯片WAIC 2026英伟达推荐理由:逛WAIC发现个新角度:国产芯片别只盯着英伟达,生态和落地才是真考验。原文稍后读已读值得跟进有用关注 国产AI芯片
22:12IT之家(博客/媒体)英伟达已向AIB交付RTX 5080 SUPER、RTX 5070 Ti SUPER和RTX 5070 SUPER三款GPU,但要求暂缓发售。原因是3GB GDDR7显存颗粒单价60-70美元,较2GB的20美元上涨超200%。这三款显卡显存分别为24GB、24GB和18GB,TDP为415W、350W和275W。入门级RTX 5050 9GB项目因成本问题被暂停。DRAM产能向AI存储倾斜导致显存短缺。AI产品RTX 50 SUPER英伟达GDDR7推荐理由:英伟达新SUPER显卡已造好却不敢卖,只因GDDR7贵得离谱,老卡RTX 3060重出江湖。原文稍后读已读值得跟进有用关注 RTX 50 SUPER
15:41IT之家(博客/媒体)苹果原计划2026年推出代号Baltra的AI服务器芯片,基于M2 Ultra改造,但因性能不足已延后发布。苹果芯片团队缺乏高功耗设计经验,今年测试中无法处理Siri AI计算负载。最终苹果将iOS 27新版Siri AI任务转移到谷歌云,使用英伟达GPU完成。行业苹果Baltra英伟达推荐理由:苹果想自研AI芯片但性能拉胯,被迫租谷歌云和英伟达GPU,说明AI硬件没那么好做。原文稍后读已读值得跟进有用关注 苹果
14:45IT之家(博客/媒体)英伟达CEO黄仁勋在东京宣布与发那科、安川电机等日本企业合作,推动机器人与AI领域的研发。黄仁勋称AI将使机器人更智能、适配更强。他还会见了铠侠、东京电子等半导体供应链高管。此外,阿斯麦上调营收预期并承诺扩大产能。行业英伟达发那科安川电机推荐理由:英伟达拉上发那科、安川电机一起搞机器人AI,黄仁勋还见了铠侠、东京电子高管,这回日本半导体供应链全凑齐了。原文稍后读已读值得跟进有用关注 英伟达
09:18IT之家(博客/媒体)71°英伟达汽车业务负责人吴新宙在The Verge播客《Decoder》中透露,英伟达内部计算GPU供应有限,不同团队需竞争资源。他每周需协调分配计算资源,有时需CEO黄仁勋介入调解。黄仁勋将自动驾驶视为“零万亿美元业务”,持续优先投入,尽管汽车部门规模远小于数据中心。随着AI公司大规模采购芯片,英伟达内部也出现芯片和晶圆厂产能的争夺。行业英伟达黄仁勋GPU推荐理由:英伟达自家芯片都不够用,黄仁勋还得亲自调解部门抢资源,汽车业务老大的内幕真刺激。原文稍后读已读值得跟进有用关注 英伟达
07:21IT之家(博客/媒体)76°丰田与英伟达于7月14日宣布扩大合作,采用NVIDIA DRIVE AGX平台和通过安全认证的DriveOS开发下一代L2++辅助驾驶汽车。双方利用英伟达加速计算和AI软件,包括基于Megatron-LM训练符合MISRA标准的Code Assistant AI模型,以加速汽车软件开发。丰田还使用NVIDIA Omniverse和Isaac Sim进行工厂仿真,并通过H100 GPU开发多模态视觉语言模型Woven City AI Vision Engine,用于城市交通智能分析。合作范围从汽车拓展至机器人和智能设施领域。行业英伟达丰田DRIVE AGX5 个信源在谈事件专题推荐理由:丰田要用英伟达DRIVE AGX做L2++辅助驾驶,还拿Omniverse仿真工厂、用Megatron-LM训练编程AI,合作面很广。原文稍后读已读值得跟进有用关注 英伟达
17:45IT之家(博客/媒体)安全公司 Blackpoint Cyber 披露木马 LabubaRAT,它使用 Rust 语言开发,伪装成“nvidia-sysruntime.exe”诱导安装。该木马通过 HTTPS、WebView2 和 DNS Tunnel 等多种方式与 C2 服务器通信,可远程命令执行、运行 PowerShell/JavaScript 脚本、截图、文件上传下载等。研究人员发现 LabubaRAT 可能以恶意软件即服务(MaaS)订阅制形式运营,扩大威胁范围。行业LabubaRAT英伟达Blackpoint Cyber5 个信源在谈事件专题推荐理由:Blackpoint Cyber 发现了用 Rust 写的 Windows 木马 LabubaRAT,伪装成英伟达驱动,能远程控制你的电脑,而且可能变成订阅制的恶意软件服务。原文稍后读已读值得跟进有用关注 LabubaRAT
16:21IT之家(博客/媒体)74°诺基亚与英伟达联合发布全球首个商用AI-RAN平台,可在相同无线频段下,到2028年实现两倍数据传输能力。该平台频谱利用效率预计提升50%,远高于当前行业20%的平均水平。硬件预计2026年开始向运营商供货,并符合Open RAN标准,可通过软件升级支持未来6G。平台采用英伟达CUDA和AI技术,将无线接入网络转变为AI计算系统。AI产品诺基亚英伟达AI-RAN推荐理由:诺基亚和英伟达搞了个商用AI-RAN平台,不用加频谱就能让数据传输翻倍,频谱效率提升50%,运营商的钱花得更值了。原文稍后读已读值得跟进有用关注 诺基亚
20:42IT之家(博客/媒体)英伟达正考虑与三菱重工在AI数据中心技术领域展开合作,拟将三菱重工的冷却系统和能源管理技术融入英伟达的下一代数据中心。三菱重工正在设计专为AI打造的下一代数据中心“DIAVAULT”,并积极开发液冷系统。英伟达将其下一代AI数据中心定位为“人工智能工厂”,计划与全球合作伙伴共同建设。此前,英伟达与OpenAI在2025年9月达成了高达1000亿美元的投资协议,用于建设AI基础设施。行业英伟达三菱重工AI数据中心10 个信源在谈事件专题推荐理由:英伟达找三菱重工合作数据中心冷却和能源管理,听起来能大幅提升效率,值得关注。原文稍后读已读值得跟进有用关注 英伟达
13:43IT之家(博客/媒体)英伟达CEO黄仁勋在深度对话中表示,AI是像吸尘器一样的工具,没有意识,不应过度拟人化。他与LangChain创始人Harrison Chase讨论企业AI未来,预测大多数公司将建立在框架之上。黄仁勋认为使用AI越多反而需要雇佣更多人,其软件工程师更倾向于构建代理程序而非写Python代码。与Anthropic CEO达里奥·阿莫迪和亚马逊CEO安迪·贾西的观点不同,黄仁勋淡化AI大规模消灭白领工作的担忧,认为AI将创造更多岗位。行业黄仁勋英伟达LangChain10 个信源在谈事件专题推荐理由:黄仁勋说AI就像吸尘器,别把它当人看。他还讲AI会创造更多工作,不是消灭白领。观点很直接,值得一看。原文稍后读已读值得跟进有用关注 黄仁勋
08:58IT之家(博客/媒体)73°英伟达CEO黄仁勋在摩根士丹利路演中表示公司季度营收即将逼近1000亿美元(约6779.96亿元人民币),并强调增长仍在加速。黄仁勋否认Rubin Ultra架构延期,称其仍按计划于2025年出货,但系统机架设计有所优化。一名曾主要依赖ASIC的前沿AI模型客户(市场指向Anthropic)已将英伟达GPU算力占比提升至接近50%。摩根士丹利维持“增持”评级,目标价288美元,预计2026财年营收增长82%、2027财年增长52.4%。英伟达指出未来三大增长引擎为AI实验室、超大规模云服务商以及主权AI和企业客户。行业英伟达黄仁勋Rubin Ultra8 个信源在谈事件专题推荐理由:英伟达正面回应ASIC竞争、架构延期和需求见顶三连问,还透露大客户转向GPU,观点很硬核。原文稍后读已读值得跟进有用关注 英伟达
07:16IT之家(博客/媒体)76°据DigiTimes报道,下一代HBM4价格预计升至每Gb 4至5美元,而2026年下半年价格约为每Gb 2美元。HBM4生产周期长达4至6个月,初期良率低,消耗晶圆产能约为DDR5的三倍。三星电子、SK海力士和美光等厂商与AI客户签订3至5年长期合同,锁定全球产能。到2027年,全球约一半DRAM产能可能无法向中小客户供应。英伟达即将推出的Rubin AI架构正在加速HBM4导入。行业HBM4SK海力士三星电子推荐理由:HBM4要涨价一倍,存储厂商赚翻了,但消费电子厂可能缺货。想了解AI硬件供应走势,这篇信息量很足。原文稍后读已读值得跟进有用关注 HBM4
09:50IT之家(博客/媒体)三星电子会长李在镕预计7月底赴美,与英伟达CEO黄仁勋在硅谷会面,距离上次2023年10月APEC会议已隔9个月。此次会谈将推动韩国“三大超级计划”,包括在光州投资800万亿韩元(约3.62万亿元人民币)建设半导体园区,以及国内超1000万亿韩元(约4.52万亿元人民币)的AI数据中心项目。英伟达AI服务器对韩国AI设施至关重要,但全球供应仍紧张。此前韩国总统李在明帮助获得26万颗英伟达AI芯片,此次会谈意在深化合作。行业李在镕黄仁勋英伟达推荐理由:三星掌门要亲自去美国谈英伟达的芯片供应,牵动韩国800万亿韩元半导体投资,想了解AI芯片供应链动态可以看看。原文稍后读已读值得跟进有用关注 李在镕
21:04IT之家(博客/媒体)73°法国竞争管理局官员确认,针对英伟达的反垄断调查已接近尾声,预计很快出具正式异议声明。该调查始于2023年9月法方突击检查英伟达法国办公室,2024年年中发布的报告指出整个生成式AI行业高度依赖英伟达CUDA平台。调查聚焦两大问题:市场对CUDA的强依赖使开发者难以转向其他硬件;英伟达对CoreWeave等AI云计算公司的投资可能强化其市场优势。英伟达占据全球AI加速器市场超70%份额,若认定滥用市场支配地位,最高可被处以全球年营业额10%的罚款(数十亿美元)。行业英伟达CUDA反垄断推荐理由:法国准备正式指控英伟达,原因是他们太依赖CUDA和投资云公司,最高可能罚几十亿美元,这案子会影响整个AI芯片格局。原文稍后读已读值得跟进有用关注 英伟达
13:49IT之家(博客/媒体)黄仁勋在采访中称,英伟达软件工程师更愿意构建智能体而不是写Python代码。AI让工程师减少传统编码,转向构建智能体、设计基准测试和设置安全护栏。他反驳AI取代员工的说法,认为AI创造新岗位,并计划在各部门大规模部署智能体提升生产力。行业黄仁勋英伟达智能体推荐理由:黄仁勋说他的工程师更喜欢搭智能体而不是写代码,还反驳了AI取代人的说法。看看这位大佬怎么看待AI对程序员工作的改变吧。原文稍后读已读值得跟进有用关注 黄仁勋
13:07IT之家(博客/媒体)精选英伟达下一代 Rosa CPU 是 Vera CPU 的后继型号,属于 Feynman 世代,预计 2028 年面世。该芯片有望采用台积电 2nm 工艺,甚至可能升级到带背面供电的 A16 制程。A16 工艺相比 N2P 可提升芯片密度 1.1 倍,其 Super Power Rail 技术将供电网络移至晶圆背面,降低 IR drop。2nm 节点的 CMP 步骤较 7nm 增加超过一倍,导入背面供电后还将额外增加 15% 至 20%。架构上 Rosa CPU 将使用自研 Rigel 核心(基于 Arm v9.2),相比前代 Olympus 核心在相同面积下追求更高单核性能。AI产品英伟达Rosa CPU台积电推荐理由:英伟达下代 CPU Rosa 用上台积电 A16 工艺,2028 年面世,密度提升 1.1 倍,背面供电降功耗,值得关注。原文稍后读已读值得跟进有用关注 英伟达
11:06IT之家(博客/媒体)淡马锡7月8日发布年度报告,计划未来五年将AI相关资产占比从6%提升至15%。重点布局五大方向:能源和数据中心、半导体、云服务、基础模型、AI应用与软件基础设施。截至2026年3月31日财年,其净投资组合价值达5180亿新元,新元计价回报率10.5%。淡马锡已持有OpenAI、Anthropic、英伟达等投资,但未披露具体AI持仓比例。同时计划到2031年将私募信贷和核心增值型基础设施占比分别提升至5%。行业淡马锡OpenAIAnthropic10 个信源在谈事件专题推荐理由:淡马锡计划五年内把AI投资占比翻倍到15%,重点砸半导体和基础模型。它手里已经有OpenAI、Anthropic和英伟达,这次加码说明AI赛道被长期看好。原文稍后读已读值得跟进有用关注 淡马锡
08:57IT之家(博客/媒体)75°英伟达宣布其 Nemotron 3 Ultra 模型在 LangChain 的 Deep Agents 基准测试中取得开源模型最高准确率。该基准测试评估智能体系统的多步推理、工具调用和任务编排能力。调优后的 Nemotron 3 Ultra 每次推理成本仅为顶级闭源模型的 1/10,同时实现更高吞吐量。在业务任务能力上,该模型通过优化模型周围环境达到顶尖闭源模型水平。AI模型Nemotron 3 Ultra英伟达Deep Agents3 个信源在谈事件专题推荐理由:英伟达开源模型 Nemotron 3 Ultra 在智能体测试中准确率最高,成本只有闭源模型的十分之一,适合想低成本构建企业智能体的团队。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
14:55IT之家(博客/媒体)74°台积电计划将PIC月产能从目前的500片提升至2026年第二季度的1万片,2028年达至少2.5万片。按每片648颗裸片计算,年化产出将从约400万颗增至2026年的7800万颗,2028年达1.94亿颗。若良率50%,对应光引擎年化产出分别为200万、3900万、9700万颗。初期客户以英伟达、博通、AMD为主,2028年后联发科、美满电子等有望导入。产能扩张标志着CPO技术进入量产准备期,并带动FAU、激光器等设备需求。行业台积电PIC英伟达推荐理由:台积电PIC产能从500片暴增至2.5万片,英伟达博通AMD先用,2028年光通信芯片量产要来了。原文稍后读已读值得跟进有用关注 台积电
13:56IT之家(博客/媒体)73°英伟达于6月发布Audex(Nemotron-Labs-Audex-30B-A3B)统一音频-文本大模型,总参数量30B,激活参数3B。该模型以Nemotron-Cascade-2-30B-A3B为骨干,采用52层混合Mamba-Transformer结构,128个可路由专家。音频编码使用AF-Whisper,语音输出用X-Codec2,非语音音频用X-Codec。文本评测中,Audex在MMLU-Redux上得分86.4(高于骨干86.3),在IMO AnswerBench上81.1(高于79.3),但在MMLU-Pro和GPQA-Diamond上小幅下降。AI模型AudexNemotron英伟达2 个信源在谈事件专题推荐理由:英伟达出了个Audex,30B参数但只激活3B,能听能说还不掉文本能力,MMLU-Redux得分86.4比原来还高一点。原文稍后读已读值得跟进有用关注 Audex
23:47IT之家(博客/媒体)72°路透社援引知情人士消息,DeepSeek(深度求索)正在自研面向 AI 推理场景的芯片,项目约一年前启动。若成功,将降低其对英伟达、华为的依赖。受此影响,英伟达盘前股价下跌约 1.6%。分析师指出,受制于制造工艺,该芯片海外市场机会有限。DeepSeek 近期低调招聘芯片设计工程师,未公开职位信息。行业DeepSeek英伟达华为推荐理由:DeepSeek 在搞自己的 AI 推理芯片,想少用英伟达和华为的货。项目才起步,但已有分析师不看好海外市场。看国产大模型如何突围硬件依赖。原文稍后读已读值得跟进有用关注 DeepSeek
12:55IT之家(博客/媒体)SemiAnalysis称因PCB中介板工艺问题,英伟达下一代AI机架系统Kyber可能延期至2028年。英伟达官方回应表示路线图保持不变,仍计划于2027年下半年随Vera Rubin Ultra芯片平台推出。Kyber NVL144机柜采用垂直插拔与正交背板技术,单机柜支持144颗GPU高速互连。行业英伟达KyberVera Rubin Ultra推荐理由:英伟达官方澄清Kyber机架平台进度,计划2027年下半年推出,搭载Vera Rubin Ultra架构,单机柜144颗GPU。原文稍后读已读值得跟进有用关注 英伟达