22:12IT之家(博客/媒体)谷歌正在研发代号 Frozen v2 的专用芯片,将 Gemini 模型底层架构固化到硬件中,单位功耗处理词元数可达现有自研 AI 芯片的 6 至 10 倍。该芯片最早计划于 2028 年部署,保留通过更新权重进行迭代的能力。Frozen v2 将与谷歌现有的 TPU 形成互补关系,而非替代。谷歌已与 Meta 签署数十亿美元 TPU 租用订单,并积极拓展云客户。行业GoogleFrozen v2Gemini推荐理由:谷歌搞了个 Frozen v2,专为 Gemini 模型定制,效率比现有芯片高 6 到 10 倍,还能更新权重。AI 芯片方向的新探索,值得关注。原文稍后读已读值得跟进有用关注 Google
02:48Amjad Masad@amasad精选AI推理成本高昂的原因之一是多数工作负载运行在预LLM时代的通用硬件上。Etched从隐身模式亮相,其系统专为现代推理从零设计。公司已获得超过10亿美元客户合同和8亿美元融资。早期测试显示,在推理工作负载上吞吐量、延迟和能效均达到SOTA。首批机架将于今年夏季发货。AI产品EtchedAI推理专用芯片5 个信源在谈事件专题推荐理由:Etched做了专为AI推理优化的芯片,比通用硬件在吞吐、延迟、能效上都做到了目前最好。今年夏天就发货,关注成本的人可以看看。原文稍后读已读值得跟进有用关注 Etched