8月22日
14:58
8月21日
15:06
8月14日
10:25
10:25官方一手Pandaily@contact@pandaily.com (Pandaily)
DeepSeek 于8月13日宣布 V4 系列 API 调价,8月17日生效。新方案采用峰谷定价,非高峰时段价格为高峰的一半。V4 Pro 输入缓存命中的非高峰价格涨幅最高达500%。同时,V4-Pro-0813 模型的 DeepSWE 得分从7.3跃升至62.7。

推荐理由:DeepSeek 把 V4 API 价格调高了,最高 500%。非高峰时段半价,要省钱就避开高峰,8月17日就改。
7月31日
20:08
20:08AI Will@FinanceYF5
精选79°
DeepSeek V4 Flash 官方API现已开启公测,重点升级Agent能力。Terminal Bench 2.1得分82.7,DeepSWE得分54.4,多项成绩大幅超过V4 Pro Preview。该模型还接近Opus 4.8的表现,并原生支持Responses API格式,现已适配Codex。

推荐理由:DeepSeek V4 Flash 公测了,Agent 跑分比 V4 Pro 高不少,还原生支持 Responses API,玩 Codex 的可以直接试。
7月23日
07:01
07:01官方账号Together AI@togethercompute
精选
使用DeepSWE基准对比了Kimi K3 Max和GPT 5.6 Sol Max在软件工程任务上的表现。Kimi K3 Max达到了与GPT 5.6 Sol Max相当的性能,而价格仅为后者的约55%。将两个模型联合使用时,性能可额外提升约16%。
事件专题

推荐理由:Kimi K3 Max性价比炸裂,软件工程能力不输GPT 5.6 Sol Max,混合使用还能再提分,值得关注。
7月19日
04:12
04:12Aravind Srinivas@AravSrinivas
Together AI 在 DeepSWE 基准上对比了 Kimi K3 与 Claude Fable 5 的软件工程任务表现。结果显示,Kimi K3 以 Fable 5 约 35% 的价格实现了相同性能,且在更高 pass@k 指标上领先。该分析来自 Together AI 的 Arav Srinivas,数据基于内部测试。
事件专题

推荐理由:想省钱又要强性能?Kimi K3 在编程任务上和 Claude Fable 5 打个平手,价格只要三分之一,高要求场景还更强。
7月18日
09:38
09:38官方账号Together AI@togethercompute
TogetherCompute使用DeepSWE评估了Kimi K3与Claude Fable 5在软件工程任务上的表现。Kimi K3以约35%的价格达到与Claude Fable 5相同的性能水平。在更高的pass@k指标上,Kimi K3甚至领先于Claude Fable 5。该分析为开发者提供了性价比更高的模型选择参考。
事件专题

推荐理由:如果你写代码,Kimi K3花不到一半的钱就能干和Claude Fable 5一样好的活,高通过率时还更强。
7月11日
02:45
6月21日
15:25
15:25@koltregaskes@koltregaskes
GLM-5.2 在 DeepSWE 编程基准上取得 44% 的得分,超过 Kimi-K2.7 Code,成为目前最强的开源模型。不过它的运行成本更高,且每次输出更多 tokens。与封闭模型相比,Claude Fable 5 以 70% 的得分领先,差距明显。

推荐理由:智谱的 GLM-5.2 代码上刚赢了 Kimi 的 K2.7,但更贵输出也更多,离顶级闭源还有距离。
6月12日