主要来源AI Will
查看原文事件专题 · 多源确认
AI计算资源紧缺:Kimi K3部署成本高达400万美元,推理性能大幅下降
Deedy指出,Kimi K3上线2天即成为OpenRouter第10大模型,每日处理约1400亿token。但由于基础设施承压,吞吐量从30tok/s降至13tok/s,端到端延迟增至72秒,首token延迟超20秒。部署K3最低需购买8块B300(成本约50万美元),推荐配置GB300 NVL72机架耗资约400万美元。Moonshot及多数美国推理提供商均面临算力瓶颈,Meta拥有约7GW算力但无明确模型规划,成为最大变数。算力需求增长超3个数量级,前沿智能性能按METR任务时间提升32倍,算力锁定者受益显著。
当前结论
算力才是AI的硬通货。看看K3上线两天就崩了,部署成本百万美金起,未来谁有算力谁说了算。
11 个信源78° AI 热度最后更新 2026/7/20 04:00:27
证据链
相关来源 1@koltregaskes
查看原文相关来源 2pandaily
查看原文相关来源 3IT之家
查看原文相关来源 4向阳乔木
查看原文相关来源 5Gary Marcus
查看原文相关来源 6vLLM
查看原文相关来源 7OpenRouter
查看原文相关来源 8Guillermo Rauch
查看原文相关来源 9Decoder
查看原文相关来源 10shao__meng
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。