8月14日
03:01
02:58
02:58Harrison Chase@hwchase17
精选
LangChain 在 docs.langchain.com 更新了 managed deepagents 的官方文档。新文档将每个 agent 组件都定义为独立文件。开发者通过点击即可查看组件在仓库中的位置和具体代码。这样配置生产环境中的 agent 结构变得更加直观。

推荐理由:搞生产级 agent 的可以看看,LangChain 把 managed deepagents 的文档重写了,每个组件一个文件,点开就能看到代码在哪,省事。
02:57
02:57官方账号Perplexity@perplexity_ai
Grok 4.6 已在 Perplexity 和 Perplexity Computer 上线。该模型在 WANDR 基准上位于性能和效率的帕累托前沿。相比 Fable 5,Grok 4.6 在结果持平的情况下成本降低超过 60%。用户现在即可在 Perplexity 生态中直接使用 Grok 4.6。
事件专题

推荐理由:Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。
02:55
02:54
02:54量子位@Jay
DeepSeek Harness 近期进行了价格调整。作者对 DeepSeek Harness 进行了深度体验。体验过后,作者认为这次的涨价是可以接受的。文章围绕 DeepSeek Harness 的体验感受与涨价合理性展开。
事件专题

推荐理由:DeepSeek Harness 涨价了,但作者体验完觉得值。想了解它到底强在哪,可以看看这篇。
02:53
02:49
02:49官方账号Decoder@Matthias Bastian
71°
谷歌在 3.6 Flash 发布仅三周后推出 Gemini 3.7 Flash,定位为编码和 AI 智能体场景的旗舰工作模型。官方基准显示,Gemini 3.7 Flash 在编码任务上超过 Claude Sonnet 5 和 GPT-5.6 Terra,而价格仅为两者的一半。新模型的价格也比三周前的 Gemini 3.6 Flash 低 50%。

推荐理由:谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
02:46
02:46lmarena.ai@lmarena_ai
精选
arena.ai更新了Code Arena: WebDev和Text Arena的帕累托前沿图。帕累托前沿展示了不同模型在多维性能上的最优组合。用户可据此快速比较模型,并跳转到对应排行榜查看详细数据。
推荐理由:想去arena.ai找代码或文本任务的最强模型?看这个帕累托前沿图,一眼就能知道哪些模型在权衡点上更值。
02:45
02:45lmarena.ai@lmarena_ai
LMArena 官方发布了 Code Arena 的 WebDev 子榜与 Text Arena 的完整排行榜。两份榜单均托管在 arena.ai 的 leaderboard 页面下。该榜单基于用户对战投票,反映模型在网页开发与文本任务上的能力对比。具体模型排名可在对应页面查看。
推荐理由:LMArena 把 Code Arena(WebDev)和 Text Arena 的完整榜单放出来了,想看模型在网页开发和文本任务上的排名,直接点链接查。
02:43
02:37
02:37HeyGen@HeyGen_Official
LiveAvatar 宣布原生集成 Cartesia,已有语音代理无需重建即可获得实时人脸表现。官方提供三种方式将 Cartesia 的声音和代理接入 AI 头像。该功能让原本局限于文本框的对话代理,能够以虚拟面部进行实时交互。
推荐理由:如果你在用 Cartesia 搭语音代理,现在可以直接在 LiveAvatar 上给它加一张实时人脸,不用改代码。
02:34
02:31
02:28
02:28官方一手OpenAI Blog博客/媒体
OpenAI发布GPT-5.6开发者指南,面向创业公司展示如何构建更快速、成本更低的AI代理。指南强调通过更聪明的模型选择来优化支出,并介绍了Responses API的新能力。文中以GPT-5.6为例,说明初创团队如何在实际开发中应用这些功能。
事件专题

推荐理由:OpenAI出了份GPT-5.6实操指南,教你怎么选模型、用新API,把AI代理做得更快更省钱。搞开发的值得一看。
02:28
02:20
02:20官方账号Perplexity@perplexity_ai
精选
Perplexity 发布了两批 Search SDK 更新,用于 Computer 环境。更新后,模型执行可靠性从 81.9% 提升到 92.6%。更高的可靠性让模型能更稳定地完成动作编排。该更新强调 SDK 的形态直接决定了模型的调用能力。

推荐理由:Perplexity 把 Search SDK 的执行可靠性从 81.9% 拉到 92.6%,做智能体编排的更稳了。
02:16
02:16Harrison Chase@hwchase17
精选
LangChain创始人Harrison Chase在红杉活动上提出智能体由框架、模型和上下文三部分组成。他认为若使用场景偏离模型训练分布,越应自建框架。他验证了LangSmith Engine的评估功能,并展示了如何通过追踪、数据飞轮优化性能。视频中还讨论了为何可观测性常被低估。

推荐理由:红杉活动上,LangChain创始人聊了智能体三件套:框架、模型、上下文。他说越偏离模型训练数据,越该自己造框架。还演示了LangSmith Engine怎么做评估。
02:13
02:13Suhail@Suhail
X用户Suhail发帖称,因一系列'疯狂事件'已完全停用Anthropic模型两周。他认为模型没有长期忠诚度,忠诚度为零,用户可随时更换。该帖目前获19条回复、122个赞和6045次浏览。
事件专题

推荐理由:Suhail发帖吐槽Anthropic模型,称已两周不用,觉得模型没忠诚度,看看他到底撞上什么事。
02:11
02:11bolt.new@boltdotnew
Bolt官方推特发布消息,宣称语音输入比打字更快。用户可以随意说出不成熟的想法,系统会自动清理。Bolt会去除“嗯”“啊”等语气词和重复内容。用户无需提前整理思路,可以全盘倒出。
推荐理由:Bolt出了个有意思的功能,动嘴说想法就行,它会自动帮你删掉“嗯啊”那些废话,适合懒得打长文的人。
02:07
02:02
02:02官方账号Logan Kilpatrick@OfficialLoganK
Gemini 3.7 Flash 正式发布,API 价格较 3.6 Flash 降低 50%,优惠持续到年底。该模型在约三周内通过算法改进实现了显著的智能提升。它已上线 API、AI Studio 和 Antigravity 等平台。官方强调其运行速度很快。

推荐理由:Gemini 3.7 Flash 来了,比 3.6 Flash 便宜一半,速度更快,想用 API 的可以试试。
01:56
01:49
01:49Google Gemini App@GeminiApp
82°
Gemini Spark 已切换至 Gemini 3.7 Flash 模型。该个人智能体可把供应商信息汇总到 Sheets,也能起草谈判邮件。Gemini 3.7 Flash 改进了对 Google Workspace 应用的工具调用能力,让指令执行更精准。相关更新已通过 Gemini App 推送。
推荐理由:Gemini 的 Spark 换上了 3.7 Flash,整供应商清单、写谈判邮件都更准了,和 Workspace 联动也更顺手。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。