6月2日
6月1日
5月29日
22:30
22:30Harrison Chase@hwchase17
LangChain 发布 Deep Agents v0.6,将“Harness Profiles”提升为一等抽象,允许为不同模型定制提示和工具。这一更新解决了模型间性能差异问题,使开发者能以低于封闭前沿 API 20 倍以上的成本,从 Kimi、Qwen 和 DeepSeek 等模型获得生产级性能。LangChain 还提供了调优指南,帮助用户优化模型配置。
推荐理由:做多模型 Agent 的团队终于不用为每个模型手写适配代码了——Harness Profiles 让不同模型自动获得最优提示和工具配置,成本直降 20 倍,建议直接看调优指南。
09:04
09:04rohanpaul_ai@rohanpaul_ai
Claude Opus 4.8 推出快模式,速度提升约 2.5 倍,成本降低 3 倍。AI/ML API 平台已集成该模式,并为部分用户提供免费访问。该平台提供单一 API 接入 500 多个 AI 模型,方便开发者快速切换。这一更新显著提升了 Claude Opus 4.8 的实用性和性价比。
事件专题

推荐理由:对于高频调用 Claude Opus 的开发者,快模式直接降低 3 倍成本并提升响应速度,AI/ML API 平台还提供免费试用,值得立即体验。
5月25日
12:12
12:12Paul Couvert@itsPaulAi
阿里巴巴发布了 Qwen-3.7-Max 模型,性能出色,可轻松接入 Hermes Agent 或 OpenCode,替代 GPT-5.5 或 Opus 4.7。输出成本比 Opus 4.7 低 3.3 倍,比 GPT-5.5 低 4 倍,输入成本也比两者低 2 倍。该模型在多个基准测试中表现优异,为开发者提供了高性价比的替代方案。
推荐理由:Qwen-3.7-Max 以极低成本提供接近顶级模型的性能,做 AI 应用开发或智能体集成的团队可以大幅降低推理开销,值得立刻上手试试。
5月23日
01:06
01:06Geek@geekbb
DeepSeek-V4-pro 模型 API 价格将在 2026年5月31日 23:59 结束 2.5 折优惠活动后,正式调整为原定价的 1/4。这意味着长期使用成本大幅降低,对开发者和大模型应用团队是重大利好。该调整是永久性的,而非短期促销。消息来自社区分享,引发广泛关注。
事件专题

推荐理由:DeepSeek-V4-pro API 价格直接降到原价1/4,做 AI 应用开发和模型调用的团队成本压力骤减,建议关注并提前规划迁移或扩容。
5月22日
5月20日
02:09
02:09官方账号Logan Kilpatrick@OfficialLoganK
78°
Google 发布了 Gemini 3.5 Flash,号称迄今为止最强大的模型,在智能、速度和成本方面均达到新高度。团队经过 6 个月优化,使其更适用于实际场景。该模型现已全面可用,旨在为开发者提供更高效、更经济的 AI 解决方案。

推荐理由:Gemini 3.5 Flash 在性能与成本之间找到了新平衡,做 AI 应用开发的团队可以直接部署,值得关注。
5月19日
5月14日