8月14日
03:23
02:58
02:58Harrison Chase@hwchase17
精选
LangChain 在 docs.langchain.com 更新了 managed deepagents 的官方文档。新文档将每个 agent 组件都定义为独立文件。开发者通过点击即可查看组件在仓库中的位置和具体代码。这样配置生产环境中的 agent 结构变得更加直观。

推荐理由:搞生产级 agent 的可以看看,LangChain 把 managed deepagents 的文档重写了,每个组件一个文件,点开就能看到代码在哪,省事。
02:53
02:49
02:49官方账号Decoder@Matthias Bastian
71°
谷歌在 3.6 Flash 发布仅三周后推出 Gemini 3.7 Flash,定位为编码和 AI 智能体场景的旗舰工作模型。官方基准显示,Gemini 3.7 Flash 在编码任务上超过 Claude Sonnet 5 和 GPT-5.6 Terra,而价格仅为两者的一半。新模型的价格也比三周前的 Gemini 3.6 Flash 低 50%。

推荐理由:谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
02:31
02:28
02:28官方一手OpenAI Blog博客/媒体
OpenAI发布GPT-5.6开发者指南,面向创业公司展示如何构建更快速、成本更低的AI代理。指南强调通过更聪明的模型选择来优化支出,并介绍了Responses API的新能力。文中以GPT-5.6为例,说明初创团队如何在实际开发中应用这些功能。
事件专题

推荐理由:OpenAI出了份GPT-5.6实操指南,教你怎么选模型、用新API,把AI代理做得更快更省钱。搞开发的值得一看。
02:20
02:20官方账号Perplexity@perplexity_ai
精选
Perplexity 发布了两批 Search SDK 更新,用于 Computer 环境。更新后,模型执行可靠性从 81.9% 提升到 92.6%。更高的可靠性让模型能更稳定地完成动作编排。该更新强调 SDK 的形态直接决定了模型的调用能力。

推荐理由:Perplexity 把 Search SDK 的执行可靠性从 81.9% 拉到 92.6%,做智能体编排的更稳了。
02:16
02:16Harrison Chase@hwchase17
精选
LangChain创始人Harrison Chase在红杉活动上提出智能体由框架、模型和上下文三部分组成。他认为若使用场景偏离模型训练分布,越应自建框架。他验证了LangSmith Engine的评估功能,并展示了如何通过追踪、数据飞轮优化性能。视频中还讨论了为何可观测性常被低估。

推荐理由:红杉活动上,LangChain创始人聊了智能体三件套:框架、模型、上下文。他说越偏离模型训练数据,越该自己造框架。还演示了LangSmith Engine怎么做评估。
01:56
01:49
01:49Google Gemini App@GeminiApp
82°
Gemini Spark 已切换至 Gemini 3.7 Flash 模型。该个人智能体可把供应商信息汇总到 Sheets,也能起草谈判邮件。Gemini 3.7 Flash 改进了对 Google Workspace 应用的工具调用能力,让指令执行更精准。相关更新已通过 Gemini App 推送。
推荐理由:Gemini 的 Spark 换上了 3.7 Flash,整供应商清单、写谈判邮件都更准了,和 Workspace 联动也更顺手。
01:45
01:36
01:36官方账号Cursor@cursor_ai
Cursor 的 Builds 功能让 Agent 更稳定、也更容易调试。当一次新的构建失败时,它不会上线运行。Agent 会继续基于上次成功的构建工作,同时开发者可在后台进行调试。
事件专题

推荐理由:Cursor 这波 Builds 功能不错,构建失败不会上线,Agent 自动用上次成功版本继续干活,你专心调试就行。
01:35
01:35官方账号Cursor@cursor_ai
精选
Cursor发布新功能Builds,旨在优化云端Agent的启动性能。Faire、Headway和Descript等客户反馈,Agent启动时间从分钟级降至秒级。这些客户正越来越信任云端Agent自主执行端到端任务。具体机制可参考cursor.com/blog/builds。
事件专题

推荐理由:Cursor的Builds让Agent启动从分钟级变秒级,Faire等客户都在用,跑端到端更省心。
01:34
01:34官方账号Cursor@cursor_ai
精选
Cursor 的 Cloud agents 现已将启动速度提升 3 倍,能够接手从开始到结束的复杂长期任务。这一性能提升来自 build——Cursor 在后台持续预生成的即用开发环境,且不额外收费。用户无需等待环境配置,可直接分派更庞大的自动化任务。
事件专题

推荐理由:Cursor 把云 agent 启动提速到原来的 3 倍,靠后台自动准备好的 build 环境,不用多花钱就能跑长任务,挺实用。
00:50
00:50官方账号Decoder@Jonathan Kemper
DeepSeek将旗舰模型V4-Pro从测试阶段转为正式发布,同时以MIT许可证开源了智能体软件Harness v0.1。API价格同步上调,缓存命中成本涨至原来的6倍。对于反复读取相同文件的智能体工作流,这是价格涨幅最大的部分。

推荐理由:DeepSeek把V4 Pro转正,开源了Harness v0.1,但缓存涨价到6倍,跑智能体工作流得多算算账。
00:24
00:24官方一手AWS Machine Learning Blog@Anand Komandooru
精选
AWS 发布了一篇基于 Amazon Bedrock AgentCore 的 M&A 尽职调查参考架构教程。该架构利用 AgentCore 实现多智能体编排,并集成知识检索与治理控制。教程附带可在 AWS 账户中直接部署的完整示例代码。示例展示了如何通过 AgentCore 分配任务给不同智能体并汇总审查结果。
推荐理由:这篇 AWS 教程把并购尽调拆给多个智能体,用 Bedrock AgentCore 就能搭,还有能直接跑的代码。
00:23
00:23官方一手AWS Machine Learning Blog@Salman Moghal
精选
AWS发布博客,介绍如何用Amazon Bedrock AgentCore Browser Tool和Strands Agents自动化需要人工交互的遗留Web应用。方案通过安全隔离的浏览器会话驱动旧界面,同时保留人工监督和完整审计日志。文章给出了参考架构,适合处理无法通过API集成的老旧系统。
事件专题

推荐理由:AWS官方出教程了,教你用AgentCore浏览器工具让AI替你操作老系统,还带审计和人工监控,搞自动化的可以看看。