7月9日
04:27
04:27Fireworks AI@FireworksAI_HQ
精选
Fireworks AI 高级成员 Shoucong Chen 使用 GLM 5.2 Fast 模型,在 4 天内完成了原计划 1 个月的复杂 SWE 项目。该模型推理速度约 400 tokens/s,总推理成本仅 218 美元。通过 FireConnect 可在 Claude Code 中调用此模型。作者认为快速推理能减少上下文切换,提升开发效率。
推荐理由:Fireworks AI 的 GLM 5.2 Fast 跑到了 400tok/s,4 天干完一个月活,才花 218 刀。想试试在 Claude Code 里提速的,直接 FireConnect 走起。