腾讯云大幅降低DeepSeek-V4系列模型调用成本,做AI应用开发或智能体集成的团队可以直接降低推理成本,缓存命中价格降幅高达97.5%,高频调用场景尤其划算,建议开发者抓紧调整预算。
腾讯云智能体开发平台宣布自2026年6月3日起,对DeepSeek-V4系列模型进行价格下调。其中DeepSeek-V4-Pro模型的推理输入与输出价格降幅达75%,缓存命中价格降幅高达97.5%;DeepSeek-V4-Flash模型的缓存命中价格降幅达90%。该系列模型总参数达1.6万亿,采用混合专家架构,原生支持100万Token上下文长度。此次降价是腾讯云在平台接入层面的进一步调整,此前DeepSeek官方已于5月23日宣布V4-Pro API永久降价。
最高降 97.5%:腾讯云智能体开发平台 DeepSeek-V4 系列模型 6 月 3 日起大幅降价
IT之家 6 月 2 日消息,腾讯云智能体开发平台宣布将于北京时间 2026 年 6 月 3 日零时起,对 DeepSeek-V4 系列模型进行价格下调。 其中 DeepSeek-V4-Pro 模型的推理输入与输出价格降幅达 75%,缓存命中价格降幅高达 97.5%;DeepSeek-V4-Flash 模型的缓存命中价格降幅达 90%。 模型名称 分类 调整前价格(元 / 千 tokens) 调整后价格(元 / 千 tokens) 降幅 DeepSeek-V4-Pro 推理输入 0.012 0.003 75% 推理输出 0.024 0.006 75% 缓存命中 0.001 0.000025 97.5% 模型名称 分类 调整前价格(元 / 千 tokens) 调整后价格(元 / 千 tokens) 降幅 DeepSeek-V4-Flash 缓存命中 0.0002 0.00002 90% DeepSeek-V4 系列大模型发布于 2026 年 4 月 24 日,包含 V4-Pro 与 V4-Flash 双版本,总参数达 1.6 万亿,采用混合专家架构,原生支持 100 万 Token 上下文长度。作为参考,DeepSeek 官方此前已于 5 月 23 日宣布将 V4-Pro 模型的 API 价格从限时优惠转为永久降价策略,而腾讯云本次调整是在平台接入层面进一步下调了调用价格。 相关阅读: 《 DeepSeek-V4-Pro API 宣布永久降价,调整为原定价的 1/4 》 《 腾讯云:智能体开发平台提供的 Hy3 preview、DeepSeek-V4-Pro 模型 27 日 10:00 起结束限免公测,正式商业化 》