模型多源确认89°

OpenAI 发布首款自研推理芯片 Jalapeño

精选理由

OpenAI 和 Broadcom 联手搞了颗推理芯片 Jalapeño,9 个月就流片了,能效比现在最好的还强,计划 2026 年底大规模部署,想自己掌控底层硬件。

OpenAI 联合 Broadcom 和 Celestica 从零设计并成功流片了首款自研 LLM 推理加速器 Jalapeño,耗时 9 个月,宣称能效显著优于当前 SOTA。该芯片专为 ChatGPT、Codex 和 API 等工作负载优化,计划从 2026 年底起以吉瓦级规模部署。此举是 OpenAI 垂直整合战略的一部分,与 Google TPU、Amazon Trainium 等路径一致,旨在通过自研芯片提升推理效率、降低成本和改善用户体验。

原文 · shao__meng

OpenAI 发布首款自研推理芯片 Jalapeño OpenAI 联合 Broadcom(和 Celestica)从零设计了一款专为 LLM 推理优化的加速器 Jalapeño,9 个月完成流片,宣称能效显著优于当前 SOTA,计划 2026 年底起以吉瓦级规模部署——这是 OpenAI 把"全栈"延伸到芯片层的标志性一步。 为什么 OpenAI 要造芯片? 官方用了 "full-stack advantage"(全栈优势) 和一个飞轮模型来论证: 更好的基础设施 → 更高算力效率 → 更好的训练与推理 → 更强模型 → 更好产品 → 更多使用与收入 → 再投入下一代基础设施。 逻辑上是把芯片作为飞轮的最底层杠杆:只有自己掌握芯片架构,才能让内核、内存、网络、调度、产品体验围绕同一目标协同优化。这与 Google(TPU)、Amazon(Trainium/Inferentia)、Meta(MTIA)走的是同一条垂直整合路径——前沿 AI 公司自研推理芯片已成行业共识。 对 OpenAI 而言,还有一个直接的商业落点:推理是 AI 触达用户的环节。每一点成本、速度、可靠性的改善,都会直接转化为更快的 ChatGPT 回答、能多走几步的 Codex 任务、更便宜的 API、以及高峰期更稳的访问。 OpenAI @OpenAI We’ve designed and built our first AI chip: Jalapeño. Designed from the ground up by OpenAI and brought to production with @Broadcom , Jalapeño is purpose-built for the LLM workloads powering ChatGPT, Codex, the API, and future agentic products. Chips are foundational to the AI economy. Building our own expands our full-stack platform from products to models to infrastructure, and will help us scale intelligence, serve more people, and expand access to AI. 🔗 View Quoted Tweet 💬 3 🔄 0 ❤️ 2 👀 386 📊 3 ⚡