SambaCloud 上 MiniMax M3 开启 Prompt Caching,输入成本降 90%
在 SambaCloud 上跑 MiniMax M3 的可以白捡一笔:长上下文缓存命中后 TTFT 快最多 4.7 倍,输入价格砍到 0.06 美元每百万 token,代码一行不用改。
在 SambaCloud 上跑 MiniMax M3 的可以白捡一笔:长上下文缓存命中后 TTFT 快最多 4.7 倍,输入价格砍到 0.06 美元每百万 token,代码一行不用改。
OpenAI 出了个缓存仪表盘,能直接看到你哪些 prompt 被复用了、哪次改动把缓存搞失效了,还给出受影响的 token 数,省钱利器。
如果你用 Codex 或 Claude Code 做长任务,这个技巧能省下不少 token 费用,fork 和 /btw 命令特别实用。