13:10AI Will@FinanceYF578°Deedy指出,Kimi K3上线2天即成为OpenRouter第10大模型,每日处理约1400亿token。但由于基础设施承压,吞吐量从30tok/s降至13tok/s,端到端延迟增至72秒,首token延迟超20秒。部署K3最低需购买8块B300(成本约50万美元),推荐配置GB300 NVL72机架耗资约400万美元。Moonshot及多数美国推理提供商均面临算力瓶颈,Meta拥有约7GW算力但无明确模型规划,成为最大变数。算力需求增长超3个数量级,前沿智能性能按METR任务时间提升32倍,算力锁定者受益显著。行业Kimi K3MoonshotOpenRouter10 个信源在谈事件专题推荐理由:算力才是AI的硬通货。看看K3上线两天就崩了,部署成本百万美金起,未来谁有算力谁说了算。原文稍后读已读值得跟进有用关注 Kimi K3
10:10官方一手pandaily@contact@pandaily.com (Pandaily)73°Moonshot AI 于 K3 模型发布仅三天后,因需求远超可用算力,暂停新消费者订阅。K3 发布获 Elon Musk 及硅谷好评。公司表示现有用户服务不受影响,但新用户加入需等待扩容完成。此次算力瓶颈凸显生成式 AI 模型规模化部署的硬件挑战。行业Moonshot AIKimiK32 个信源在谈事件专题推荐理由:Moonshot AI 刚发 K3 就被用户挤爆了,算力跟不上只能暂停新订阅,看看这个国产模型怎么火的。原文稍后读已读值得跟进有用关注 Moonshot AI
04:55Ethan Mollick@emollickEthan Mollick指出,当前AI算力严重短缺,这将导致复杂智能体工作流的计算成本大幅上升,而单轮对话聊天机器人则越来越便宜。这意味着最富有的公司和最紧迫的用例将能够使用AI智能体,而其他用户可能只能使用聊天机器人。这一趋势可能加剧AI应用中的不平等现象。行业算力短缺AI智能体聊天机器人推荐理由:算力短缺正在重塑AI应用格局,做AI智能体开发的团队需要关注成本变化,而普通用户则可能面临功能分化——建议点开了解这一趋势对自身的影响。原文稍后读已读值得跟进有用关注 算力短缺