8月14日
03:34
03:32
03:23
03:01
02:58
02:58Harrison Chase@hwchase17
精选
LangChain 在 docs.langchain.com 更新了 managed deepagents 的官方文档。新文档将每个 agent 组件都定义为独立文件。开发者通过点击即可查看组件在仓库中的位置和具体代码。这样配置生产环境中的 agent 结构变得更加直观。

推荐理由:搞生产级 agent 的可以看看,LangChain 把 managed deepagents 的文档重写了,每个组件一个文件,点开就能看到代码在哪,省事。
02:57
02:57官方账号Perplexity@perplexity_ai
Grok 4.6 已在 Perplexity 和 Perplexity Computer 上线。该模型在 WANDR 基准上位于性能和效率的帕累托前沿。相比 Fable 5,Grok 4.6 在结果持平的情况下成本降低超过 60%。用户现在即可在 Perplexity 生态中直接使用 Grok 4.6。
事件专题

推荐理由:Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。
02:55
02:54
02:54量子位@Jay
DeepSeek Harness 近期进行了价格调整。作者对 DeepSeek Harness 进行了深度体验。体验过后,作者认为这次的涨价是可以接受的。文章围绕 DeepSeek Harness 的体验感受与涨价合理性展开。
事件专题

推荐理由:DeepSeek Harness 涨价了,但作者体验完觉得值。想了解它到底强在哪,可以看看这篇。
02:53
02:49
02:49官方账号Decoder@Matthias Bastian
71°
谷歌在 3.6 Flash 发布仅三周后推出 Gemini 3.7 Flash,定位为编码和 AI 智能体场景的旗舰工作模型。官方基准显示,Gemini 3.7 Flash 在编码任务上超过 Claude Sonnet 5 和 GPT-5.6 Terra,而价格仅为两者的一半。新模型的价格也比三周前的 Gemini 3.6 Flash 低 50%。

推荐理由:谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
02:46
02:46lmarena.ai@lmarena_ai
精选
arena.ai更新了Code Arena: WebDev和Text Arena的帕累托前沿图。帕累托前沿展示了不同模型在多维性能上的最优组合。用户可据此快速比较模型,并跳转到对应排行榜查看详细数据。
推荐理由:想去arena.ai找代码或文本任务的最强模型?看这个帕累托前沿图,一眼就能知道哪些模型在权衡点上更值。
02:45
02:45lmarena.ai@lmarena_ai
LMArena 官方发布了 Code Arena 的 WebDev 子榜与 Text Arena 的完整排行榜。两份榜单均托管在 arena.ai 的 leaderboard 页面下。该榜单基于用户对战投票,反映模型在网页开发与文本任务上的能力对比。具体模型排名可在对应页面查看。
推荐理由:LMArena 把 Code Arena(WebDev)和 Text Arena 的完整榜单放出来了,想看模型在网页开发和文本任务上的排名,直接点链接查。
02:43
02:37
02:37HeyGen@HeyGen_Official
LiveAvatar 宣布原生集成 Cartesia,已有语音代理无需重建即可获得实时人脸表现。官方提供三种方式将 Cartesia 的声音和代理接入 AI 头像。该功能让原本局限于文本框的对话代理,能够以虚拟面部进行实时交互。
推荐理由:如果你在用 Cartesia 搭语音代理,现在可以直接在 LiveAvatar 上给它加一张实时人脸,不用改代码。
02:34
02:31
02:28
02:28官方一手OpenAI Blog博客/媒体
OpenAI发布GPT-5.6开发者指南,面向创业公司展示如何构建更快速、成本更低的AI代理。指南强调通过更聪明的模型选择来优化支出,并介绍了Responses API的新能力。文中以GPT-5.6为例,说明初创团队如何在实际开发中应用这些功能。
事件专题

推荐理由:OpenAI出了份GPT-5.6实操指南,教你怎么选模型、用新API,把AI代理做得更快更省钱。搞开发的值得一看。
02:28

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。