8月23日
14:43
7月31日
02:20
02:20官方一手@OpenAIDevs@OpenAIDevs
76°
OpenAI宣布API中GPT-5.6模型降价,Luna降价80%,Terra降价20%。同时推出GPT-5.6 Sol的更快选项。降价也适用于Codex和ChatGPT Work的用量计算,使开发者以更低成本获得更多智能。此次调整旨在提升成本效率,让每美元产出更多结果。
事件专题

推荐理由:OpenAI把GPT-5.6 API价格打下来了,Luna降八成,Terra降两成,还给了更快选项Sol,开发成本更低了。
7月10日
10:53
10:53官方一手Pandaily@contact@pandaily.com (Pandaily)
精选
DeepSeek、智谱AI和Qwen的成本高效模型在OpenRouter平台上周令牌份额超过20%,数据基于2025年7月的统计。这一增长显示开发者正从高价模型转向性价比更高的选项。结构性的市场转变表明成本正在成为AI基础设施选择的关键因素。

推荐理由:开发者的钱袋更聪明了:DeepSeek、智谱、Qwen靠低价拿下OpenRouter五分之一流量,值得关注。
7月9日
05:57
05:57Thomas Wolf@Thom_Wolf
精选
Matei Zaharia指出,在LLM推理中,使用简单的Pi harness(来自@badlogicgames)在Opus和GPT 5.5上达到了与LLM供应商提供的harness相同的成功率,但成本降低了一半。这种成本优势主要归因于更小的输入规模。该发现揭示了harness设计对性价比的巨大影响。
推荐理由:你知道吗?换个简单的工具就能把成本砍半,效果还不打折!Pi harness让Opus和GPT 5.5的推理省钱又高效,值得一试。
6月16日
16:17
16:17官方一手pandaily@contact@pandaily.com (Pandaily)
中国国产大模型通过多模型动态路由(Fusion)技术,在推理时动态选择最佳模型以平衡性能与成本。混合智能体架构将多个模型组合成系统,进一步降低部署开销。这种策略优先考虑实际应用的成本效率,而非单纯追求原始基准分数。

推荐理由:中国大模型厂商正在用多模型路由和混合智能体降低AI应用成本,比单纯堆参数更实用。
6月6日
09:43
09:43官方一手Pandaily@contact@pandaily.com (Pandaily)
精选
StepFun 最新模型 Step 3.7 Flash 在 Artificial Analysis 基准测试中夺得速度、成本效率和端到端性能三项第一。该模型在 OpenRouter 和 Hugging Face 上获得大量关注,展现出强大的竞争力。这一成绩表明 StepFun 在推理优化和成本控制方面取得了显著突破,为开发者提供了高性价比的 AI 模型选择。

推荐理由:做 AI 应用选型或部署推理服务的团队,Step 3.7 Flash 在速度和成本上的优势值得直接对比测试,可能帮你省下不少预算。
5月31日
22:54
22:54Viking@vikingmute
DeepSWE 对 Opus 4.8 的评分显示,该模型在性能上优于 Opus 4.7,且成本更低、效率更高,但相比 GPT5.5 仍有明显差距。作者表示尚未深度使用 4.8,仍在使用更便宜的 4.6 版本,并指出对基准测试已逐渐祛魅,更看重推特上的真实用户评价。目前普遍认为 GPT5.5 仍是大多数用户的最强模型。
事件专题

推荐理由:如果你在纠结是否升级到 Opus 4.8,这篇推文帮你省了试错成本——作者用真实体验告诉你,4.8 性价比提升但远不及 GPT5.5,做模型选型的开发者建议看看推文下的真实讨论。
5月23日
5月19日
00:53
00:53TestingCatalog@testingcatalog
78°
Cursor 发布了 Composer 2.5,该版本在性能上与 Opus 4.7 相当,但成本效率提升了最多 10 倍。新版本更智能,能更好地处理长时间运行的任务,并更可靠地遵循复杂指令。未来一周内,Composer 2.5 的使用限制将翻倍。这对使用 AI 编程助手的开发者来说是一个重大升级。
事件专题

推荐理由:Cursor 用户终于等来了性能与成本兼顾的升级——Composer 2.5 在复杂任务上更可靠,且成本大幅降低,做 AI 编程的团队建议立即试用。