20:33官方账号Decoder@Maximilian Schreiner精选Nvidia 的 Groq 3 LPX 推理芯片进入量产,Gemma 4 31B 上每秒处理 3,400 个 token,是 Cerebras 的四倍。但需要至少 64 个加速器,而 Cerebras 只需一个或两个,架构在大 MoE 模型上的扩展性仍待定。AI模型NvidiaGroq 3 LPXCerebras3 个信源在谈事件专题推荐理由:Nvidia 的 Groq 3 LPX 芯片在性能上超越了 Cerebras,但需要更多加速器,了解其扩展性如何。原文稍后读已读值得跟进有用关注 Nvidia
18:28官方账号Decoder@Maximilian SchreinerCerebras推出CS-4 AI加速器,CEO Andrew Feldman称其为行业最快系统。CS-4在相同芯片上实现性能翻倍。AI模型CerebrasAI加速器性能翻倍推荐理由:Cerebras发布CS-4,性能翻倍,行业领先!原文稍后读已读值得跟进有用关注 Cerebras
01:32techcrunch@Marina TemkinAdit Singh加入Mayfield担任基础设施合伙人。他将在Mayfield负责半导体、网络安全和物理AI领域的投资。Singh是Cerebras的早期投资人。他将专注于半导体、网络安全和物理AI领域的投资。行业CerebrasMayfieldAdit Singh推荐理由:Cerebras早期投资人Adit Singh加入了Mayfield,他负责半导体、网络安全和物理AI的投资,这可能会影响AI硬件领域的投资方向。原文稍后读已读值得跟进有用关注 Cerebras
11:48IT之家(博客/媒体)精选Cerebras推出新一代芯片WSE-3 Turbo和基于该芯片的CS-4系统,与上代CS-3相比带来10倍词元容量和2倍速度。WSE-3 Turbo集成90万个核心和44GB SRAM片上缓存,其FP16稀疏AI算力、内存带宽、片上互联带宽、I/O带宽均实现翻倍。CS-4系统在OpenAI GPT-OSS模型上拥有4465 Token/s的词元交付速度,是GPU方案的30倍,较CS-3提升93%。对于超高参数模型,CS-4的2μs低延迟晶圆间互连能在10T规模上实现超1000 Token/s的词元输出。AI产品CerebrasWSE-3 TurboCS-410 个信源在谈事件专题推荐理由:Cerebras新推WSE-3 Turbo芯片和CS-4系统,词元容量提升10倍,速度是GPU方案的30倍。原文稍后读已读值得跟进有用关注 Cerebras
22:35官方账号Decoder@Matthias Bastian78°OpenAI推出全新推理模式Ultrafast,将GPT-5.6 Sol的输出速度提升至每秒750个token,较之前快14倍。该模式基于与Cerebras的100亿美元合作,使用其专用硬件。OpenAI同时提供Standard、Fast和Ultrafast三档定价,将推理速度作为独立产品出售。AI产品OpenAIGPT-5.6 SolCerebras10 个信源在谈事件专题推荐理由:用Cerebras硬件把GPT-5.6 Sol提速到每秒750 token,还分三档收费,速度本身成了卖点。原文稍后读已读值得跟进有用关注 OpenAI
07:05IT之家(博客/媒体)78°OpenAI 以预览形式推出 GPT-5.6 Sol 的 Ultrafast 模式,由 Cerebras 提供支持,输出速度达到标准处理的 14 倍,最高每秒输出 750 个词元。该模式针对事故响应、金融研究、客服语音、电商问答等实时性要求高的场景。目前仅向一小批客户开放,早期测试将用于判断速度提升在哪些环节价值最大。AI模型OpenAIGPT-5.6 SolCerebras10 个信源在谈事件专题推荐理由:OpenAI 给最强模型 GPT-5.6 Sol 上了个超快模式,每秒能出 750 个词元,比原来快 14 倍,适合客服、金融这些要抢时间的活儿。原文稍后读已读值得跟进有用关注 OpenAI
01:15官方账号OpenAI@OpenAI78°OpenAI发布由Cerebras驱动的Ultrafast,生成速度最高达每秒750 tokens。该服务将OpenAI最先进的模型引入实时语音和客户支持等场景。还覆盖商务、编程、设计、金融研究和安全响应等企业工作流。官方称这种高速度能为企业带来可衡量的竞争优势。AI产品OpenAICerebrasUltrafast10 个信源在谈事件专题推荐理由:OpenAI新推Ultrafast,由Cerebras加速,每秒能生成750 tokens,主打实时语音和客服,速度快,试试看。原文稍后读已读值得跟进有用关注 OpenAI
01:03官方一手OpenAI Blog(博客/媒体)81°OpenAI预览全新API服务层Ultrafast,专用于运行GPT-5.6 Sol模型。该服务输出速度可达每秒750个token。相比常规模式,生成速度最高提升14倍。算力由Cerebras提供支持。AI产品OpenAIGPT-5.6 SolCerebras10 个信源在谈事件专题推荐理由:OpenAI搞了个叫Ultrafast的API新档位,跑GPT-5.6 Sol能快14倍,每秒750 token,用的是Cerebras的芯片。原文稍后读已读值得跟进有用关注 OpenAI
09:47IT之家(博客/媒体)OpenAI 研究员 Jeffrey Wang 称赞 AMD 与 Cerebras 联合开发的 AI 推理解决方案性能“令人难以置信”。该方案整合 AMD Helios 机架(处理提示词与大上下文)和 Cerebras 晶圆级引擎(负责 Token 生成,超低延迟),预计每瓦每秒 token 数量提升 5 倍。Wang 表示,内部在 Cerebras 芯片上运行 OpenAI 模型,推理速度极快,任务切换瞬间完成。行业AMDCerebrasOpenAI10 个信源在谈事件专题推荐理由:OpenAI研究员认证!AMD和Cerebras合作搞的AI推理方案,延迟低到任务秒完成,每瓦性能提升5倍,搞AI推理的可以看看。原文稍后读已读值得跟进有用关注 AMD
14:44AI Will@FinanceYF5精选Deedy总结了2026年AI芯片初创公司挑战Nvidia主导地位的六种策略。Groq通过消除DRAM减少数据移动,Cerebras消除片间互连,d-Matrix消除计算与内存的物理分离,Majestic消除服务器计算中心主义,Etched、Taalas、MatX放弃通用性追求专用化,Substrate则消除昂贵的EUV光刻机(价值4亿美元)。这些方案均针对Nvidia体系的数据移动瓶颈,试图从不同角度打破垄断。行业AI芯片NvidiaGroq10 个信源在谈事件专题推荐理由:Deedy一张图讲清了7家AI芯片新秀怎么从不同方向围攻Nvidia,思路清晰,适合快速了解竞争格局。原文稍后读已读值得跟进有用关注 AI芯片
13:55IT之家(博客/媒体)71°AMD与Cerebras在Advancing AI 2026活动中宣布联合开发AI推理解决方案,针对超低延迟场景。方案整合AMD Helios机架和Cerebras Wafer-Scale Engine,分别处理提示词/大上下文和Token生成/解码环节。结合使用2个计算引擎,预计将每瓦每秒token吞吐提升5倍。Cerebras晶圆级引擎在单块硅片上集成数十万个核心和数十GB SRAM,以减少外部网络瓶颈。行业AMDCerebrasHelios推荐理由:AMD和Cerebras联手搞推理方案,把Helios和晶圆引擎用在推理上,每瓦token吞吐能翻5倍,专治英伟达Groq组合。原文稍后读已读值得跟进有用关注 AMD
01:51IT之家(博客/媒体)AMD和Cerebras Systems宣布技术合作,整合AMD Helios机架级解决方案与Cerebras晶圆级引擎(搭载大型AI芯片)。组合产品将处理超高吞吐量提示和大上下文窗口,Cerebras提供低延迟token生成能力。计划2026年下半年通过Cerebras Cloud首先推出,后续更广泛开放。受消息影响,Cerebras股价盘中上涨11%。行业AMDCerebrasHelios推荐理由:俩公司把高吞吐和低延迟硬件凑一块,2026年推云服务。合作消息一出,Cerebras股价涨11%,说明市场很看好。原文稍后读已读值得跟进有用关注 AMD
23:57官方账号Andrew Ng@AndrewYNg精选Andrew Ng联合Cerebras推出新课程,教授如何通过推理优化硬件加速LLM应用。课程聚焦Cerebras Wafer-Scale Engine,该硬件通过减少权重搬运实现比典型GPU快数倍的token生成。学员将对比GPU、TPU和Cerebras的架构差异,并动手构建网页个性化、市场信号多步分析等实时应用。课程还涵盖利用快速推理优化代理编码工作流,适合延迟敏感场景。技巧CerebrasAndrew NgDeepLearning.AI推荐理由:吴恩达亲自推的实战课,教你用Cerebras芯片让LLM推理快几倍,还能做实时翻译和语音agent,想上手硬核加速的别错过。原文稍后读已读值得跟进有用关注 Cerebras
00:10DeepLearning.AI@DeepLearningAIDeepLearning.AI 与 Cerebras 合作推出短期课程「Fast LLM Inference with Cerebras」,教你利用 Wafer-Scale Engine 实现比典型 GPU 快数倍的推理速度。你将构建一个能根据用户交互实时个性化自身的网页,组装一个多工具工作流,在一次响应中分析市场信号,并掌握更干净的 agentic 编码习惯。课程由 Zhenny DeZ、Sebastian Duerr 和 MilksandMatcha 讲授,免费注册。技巧CerebrasDeepLearning.AILLM推理推荐理由:想用 Cerebras 的晶圆级引擎做超快推理?这个免费课教你搭实时个性化网页和复杂工作流,比 GPU 快好几倍。原文稍后读已读值得跟进有用关注 Cerebras
07:58IT之家(博客/媒体)芯片板块近期剧烈波动,市场担忧AI需求是否降温。英特尔前CEO基辛格称AI需求近乎无限,主要受能源供应限制。Cerebras CEO费尔德曼指出算力需求远超产能,Lumentum未来五年产能已售罄。企业开始从盲目使用转向关注投资回报率,DeepSeek等低成本开源模型受到更多关注。不同模型将针对不同任务分工,提升整体效率。行业芯片AI算力企业AI应用推荐理由:芯片股跌了别慌!基辛格、Cerebras都说AI需求没凉,企业只是更精打细算了。原文稍后读已读值得跟进有用关注 芯片
08:55AI Engineer@aiDotEngineer精选OpenAI宣布模型发布周期缩短至6周一次。GPT 5.6在Cerebras硬件上的推理速度达到750 tokens/s,可在10秒内完成大量代码审查。公司称2025年聚焦“token最大化”,2026年转向“价值最大化”。这一策略变化反映了AI部署从追求吞吐量向实际应用价值的转变。行业OpenAIGPT-5.6Cerebras10 个信源在谈事件专题推荐理由:OpenAI调整了模型发布节奏,以后每6周就能看到新版本。GPT 5.6在Cerebras上跑出750 tokens/s的推理速度,10秒就能处理一大波PR。2026年的重点从刷速度变成了追求实际价值。原文稍后读已读值得跟进有用关注 OpenAI
15:40IT之家(博客/媒体)AI芯片制造商Cerebras Systems宣布大幅扩展欧洲基础设施,计划2026年底前启用首批欧洲数据中心算力,并推进法国和北欧建设。到2027年底,欧洲总算力容量将扩展至200兆瓦,部分算力将用于支持OpenAI工作负载。此次扩张旨在为欧洲用户提供更低延迟的AI推理服务,满足本地化算力需求。行业Cerebras算力扩张欧洲数据中心10 个信源在谈事件专题推荐理由:Cerebras要在欧洲建数据中心了,到2027年底容量200兆瓦,还给OpenAI提供算力。想了解AI芯片厂商的海外布局可以看这个。原文稍后读已读值得跟进有用关注 Cerebras
16:53@koltregaskes@koltregaskes78°Bleys 根据公开信息估算,OpenAI 的 GPT-5.6 Sol 模型总参数在 2-4 万亿之间,采用 MoE 架构,每任务激活约 1500 亿参数。模型被分布在 70-100 个 Cerebras 晶圆上,每晶圆是一个巨型芯片,全模型约 70-90 层,最多每晶圆一层以避免瓶颈。由于专为 Cerebras 芯片设计,推理速度可达 750 tokens/s,但使用成本可能比现有模型高出数倍。AI模型GPT-5.6 SolCerebrasMoE10 个信源在谈事件专题推荐理由:Bleys 算了一笔账:GPT-5.6 Sol 参数 2-4 万亿、跑在 Cerebras 晶圆上、速度 750 token/s,但价格可能翻倍。想了解下一代超大规模模型怎么造?看这个。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
16:51@koltregaskes@koltregaskes73°OpenAI 宣布其大型模型 GPT-5.6 Sol 将在 Cerebras 硬件上提供推理服务,速度高达 750 tokens 每秒。官方表示该版本与原始模型“相同”,但可能在上下文窗口大小等参数上有调整。该部署预计显著提升推理效率,适用于高吞吐场景。AI模型GPT-5.6 SolOpenAICerebras10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 Sol 放到 Cerebras 上跑,推理速度飙到 750 tokens/s,比常规部署快很多,适合追求低延迟的场景。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
11:52AI Will@FinanceYF5过去一周内,多家AI基础设施初创公司表现亮眼,包括Modal、Cerebras、Exa和TurboPuffer。这些公司分别在算力、搜索、数据处理等关键领域取得突破,显示出AI基础设施赛道的强劲增长势头。投资者和开发者应关注这一趋势,它可能改变AI应用的底层支撑格局。行业AI基础设施ModalCerebras推荐理由:AI基础设施是当前最热赛道之一,Modal、Cerebras等公司一周内集体爆发,做AI应用或模型训练的团队值得关注,可能找到更高效、低成本的底层方案。原文稍后读已读值得跟进有用关注 AI基础设施
11:51AI Will@FinanceYF5近期,多家AI基础设施初创公司表现出色,包括Modal、Cerebras、Exa和Turbopuffer等。这些公司在上周内均有重要进展或成果发布,显示出AI基础设施领域的活力和增长潜力。这一趋势表明,AI应用对底层计算、数据检索和存储的需求正在快速上升,相关初创公司正成为行业关键参与者。行业AI基础设施初创公司Modal推荐理由:AI基础设施是当前最热门的赛道之一,关注这些初创公司的动态能帮你把握技术趋势和投资机会。做AI应用或模型训练的团队,值得了解这些新玩家的产品和服务。原文稍后读已读值得跟进有用关注 AI基础设施
05:51rohanpaul_ai@rohanpaul_aiCerebras 宣布其晶圆级芯片在 1 万亿参数的 Kimi K2.6 模型上达到了 981 tokens/sec 的推理速度,经 Artificial Analysis 验证,比最快的 GPU 云快 6.7 倍。传统 GPU 集群因跨芯片拆分模型导致大量数据传递延迟,而 Cerebras 的晶圆级芯片将整个处理器构建在单个硅晶圆上,片上路由带宽更高、延迟更低。这一速度优势对于企业级编程智能体等需要快速迭代测试和调试的场景尤为关键。Cerebras 声称其真正的商业价值不在于单纯的速度,而在于能在足够大的模型上实现这种速度,从而支撑企业级应用。AI产品CerebrasKimi K2.6推理速度推荐理由:做企业级 AI 推理或编程智能体的团队,如果被 GPU 集群的延迟和带宽瓶颈困扰,Cerebras 的晶圆级方案值得关注——它用硬件架构创新解决了模型权重和激活值传输的痛点,实测数据比 GPU 云快一个数量级。原文稍后读已读值得跟进有用关注 Cerebras
02:47AI Engineer@aiDotEngineer精选Codex Spark生成代码速度达1200 tokens/秒,而Sonnet和Opus仅40-60 tokens/秒,快了约20倍。Cerebras的@MilksandMatcha指出,若开发者习惯不佳,更快速度只会导致更快生产坏代码。他提供了实用指南视频,帮助适应高速生成。技巧Codex SparkSonnetOpus推荐理由:Cerebras教你避免快速写坏代码原文稍后读已读值得跟进有用关注 Codex Spark
01:20rohanpaul_ai@rohanpaul_aiOpenAI 联合创始人 Greg Brockman 在播客中透露,2017 年团队开始认真思考如何实现 AGI 时,发现算力需求远超预期。他们接触了 Cerebras 等公司,意识到需要大量专用硬件和大型数据中心。非营利筹款存在上限,无法支撑如此巨大的投入。因此,Elon Musk、Sam Altman、Ilya Sutskever 和 Brockman 一致同意,必须创建营利实体才能继续推进 AGI 使命。这一决策标志着 OpenAI 从非营利根基转向混合结构,也揭示了 AI 研发中算力成本的关键作用。行业OpenAIAGI算力10 个信源在谈事件专题推荐理由:这段内部决策过程揭示了 AI 研发中算力成本如何倒逼组织变革,对关注 AI 产业趋势和创业模式的读者有启发——非营利模式在资本密集型领域可能行不通。原文稍后读已读值得跟进有用关注 OpenAI
09:08shao__meng@shao__meng76°Cerebras 宣布为 Moonshot AI 的 Kimi K2.6 模型(超 1T 参数)提供企业级高速推理服务,速度达到约 1000 tokens/s,成为 Artificial Analysis 评测中速度最快的前沿模型。此前 Kimi K2.5 和 K2.6 虽模型能力强,但官方推理速度慢,而 Groq 被 Nvidia 收购后未再跟进主流模型推理。Cerebras 继为 GPT 5.3 Codex Spark 提供高速推理后,再次解决大型模型的推理瓶颈,让开发者能更高效地使用该模型。AI产品Kimi K2.6Cerebras高速推理3 个信源在谈事件专题推荐理由:Kimi K2.6 终于有了匹配其模型能力的高速推理平台,做推理密集型应用或需要实时响应的开发者可以直接用起来,体验 ~1000 tokens/s 的流畅感。原文稍后读已读值得跟进有用关注 Kimi K2.6
07:10官方账号Clement Delangue@ClementDelangue精选Cerebras 正在企业测试中运行 Kimi K2.6,这是一个万亿参数模型。据 Artificial Analysis 测量,其推理速度约为每秒1000个 token,是迄今最快的前沿模型性能。这反驳了此前认为开源大模型无法快速运行的质疑。AI模型CerebrasKimi K2.6推理速度推荐理由:Cerebras 让万亿参数模型跑出千 token 每秒原文稍后读已读值得跟进有用关注 Cerebras
10:56IT之家(博客/媒体)据彭博社报道,Arm 及其控股股东软银在 Cerebras 预计进行 IPO 前数周曾表达收购意向,但被 Cerebras 拒绝。Cerebras 是一家晶圆级 AI 推理解码加速器制造商,有望创下今年全球 IPO 规模纪录。该公司近日两次上调股票发行价格至每股 185 美元,预计筹集 55.5 亿美元,市值约 400 亿美元。这一事件凸显了 AI 芯片市场的激烈竞争和 Cerebras 的独立发展决心。行业CerebrasArm软银推荐理由:Cerebras 拒绝软银和 Arm 的收购,选择独立 IPO,这对关注 AI 芯片赛道和半导体投资的读者来说是一个重要信号——晶圆级 AI 加速器的市场价值正在被重估,值得关注其后续上市表现。原文稍后读已读值得跟进有用关注 Cerebras