SF Tech Week 上 Cerebras 和 GenSpark 办了场圆桌,聊智能体和模型公司怎么拼速度,还有几条招人建议。
#Cerebras
Genspark 办的线下活动,Cerebras、Cognition、TikTok 这些公司的人都会到场聊,感兴趣可以看下议程。
Cerebras 的 CEO 在播客里讲得很直白:别人抢 HBM 和台积电 3nm 产能,他家芯片用 5nm、不要 CoWoS,供应逻辑完全不一样,听听他们怎么绕开的。
Cerebras 的 CEO 亲自讲清楚自家芯片为什么比 GPU 快 2500 倍,关键就在权重存在 SRAM 而不是 HBM,听完就懂。
阿里巴巴用Qwen 3.8 27B模型做了个个人财务助手,能帮你把买房问题变成对话和财务目标,比以前快。
想了解最新AI芯片动态的朋友,不要错过这次大会,OpenAI的Jalapeño、Cerebras的CS-5、Groq的3 LPX和苹果的M6芯片各有特色,值得关注。
Cerebras早期投资人Adit Singh加入了Mayfield,他负责半导体、网络安全和物理AI的投资,这可能会影响AI硬件领域的投资方向。
OpenAI 给最强模型 GPT-5.6 Sol 上了个超快模式,每秒能出 750 个词元,比原来快 14 倍,适合客服、金融这些要抢时间的活儿。
OpenAI新推Ultrafast,由Cerebras加速,每秒能生成750 tokens,主打实时语音和客服,速度快,试试看。
OpenAI搞了个叫Ultrafast的API新档位,跑GPT-5.6 Sol能快14倍,每秒750 token,用的是Cerebras的芯片。
OpenAI研究员认证!AMD和Cerebras合作搞的AI推理方案,延迟低到任务秒完成,每瓦性能提升5倍,搞AI推理的可以看看。
AMD和Cerebras联手搞推理方案,把Helios和晶圆引擎用在推理上,每瓦token吞吐能翻5倍,专治英伟达Groq组合。
俩公司把高吞吐和低延迟硬件凑一块,2026年推云服务。合作消息一出,Cerebras股价涨11%,说明市场很看好。
吴恩达亲自推的实战课,教你用Cerebras芯片让LLM推理快几倍,还能做实时翻译和语音agent,想上手硬核加速的别错过。
OpenAI调整了模型发布节奏,以后每6周就能看到新版本。GPT 5.6在Cerebras上跑出750 tokens/s的推理速度,10秒就能处理一大波PR。2026年的重点从刷速度变成了追求实际价值。
Bleys 算了一笔账:GPT-5.6 Sol 参数 2-4 万亿、跑在 Cerebras 晶圆上、速度 750 token/s,但价格可能翻倍。想了解下一代超大规模模型怎么造?看这个。
OpenAI 把 GPT-5.6 Sol 放到 Cerebras 上跑,推理速度飙到 750 tokens/s,比常规部署快很多,适合追求低延迟的场景。
AI基础设施是当前最热赛道之一,Modal、Cerebras等公司一周内集体爆发,做AI应用或模型训练的团队值得关注,可能找到更高效、低成本的底层方案。
AI基础设施是当前最热门的赛道之一,关注这些初创公司的动态能帮你把握技术趋势和投资机会。做AI应用或模型训练的团队,值得了解这些新玩家的产品和服务。
做企业级 AI 推理或编程智能体的团队,如果被 GPU 集群的延迟和带宽瓶颈困扰,Cerebras 的晶圆级方案值得关注——它用硬件架构创新解决了模型权重和激活值传输的痛点,实测数据比 GPU 云快一个数量级。
这段内部决策过程揭示了 AI 研发中算力成本如何倒逼组织变革,对关注 AI 产业趋势和创业模式的读者有启发——非营利模式在资本密集型领域可能行不通。
Kimi K2.6 终于有了匹配其模型能力的高速推理平台,做推理密集型应用或需要实时响应的开发者可以直接用起来,体验 ~1000 tokens/s 的流畅感。
Cerebras 拒绝软银和 Arm 的收购,选择独立 IPO,这对关注 AI 芯片赛道和半导体投资的读者来说是一个重要信号——晶圆级 AI 加速器的市场价值正在被重估,值得关注其后续上市表现。