8月14日
18:10
15:12
13:11
13:11shao__meng@shao__meng
精选76°
DeepSeek Harness开源发布,开发者可自行安装体验。一位用户使用DeepSeek V4 Flash模型,消耗1390万Token、耗时30多分钟生成一个网站。生成结果不理想,该用户认为远不如Codex搭配GPT-5.6的组合。帖子当前获得729次浏览和4条回复。
事件专题

推荐理由:DeepSeek Harness开源了,但有人试完说生成的网站不如Codex+GPT-5.6,你装之前先看看这个。
11:43
11:43Aravind Srinivas@AravSrinivas
精选
Perplexity宣布将Sonar迁移至Agent API。该API在保持联网搜索的基础上,新增多步研究、代码执行、内建工具,并可通过单一接口访问多种模型。在BrowseComp和WideSearch基准上,Agent API的得分超过Sonar最佳成绩的两倍。
推荐理由:做联网搜索Agent?Perplexity Agent API支持多步研究、代码执行,基准分翻倍,值得一试。
10:50
07:35
07:35官方账号xAI@xai
Signal 是一个获第二名的新工具,它把关注者的简介、帖子和互动数据整合进动态图谱。它利用模拟的关注者群体,对不同的发布方案进行 A/B 测试。测试目标是让每一条新帖子都获得最大程度的互动。
推荐理由:这个 Signal 工具很实用,它能模拟你的粉丝群来测哪种发帖打法互动最高,拿第二名不奇怪。
05:50
05:41
05:39
05:39Cognition@cognition_labs
Cognition 宣布在 Devin 中集成 Gemini 3.7 Flash。该模型在处理小范围代码重构时表现突出,生成的 diff 能贴合仓库既有规范。Gemini 3.7 Flash 在 Devin 内提供五折优惠,持续两周,截止 2026 年 8 月 27 日。
推荐理由:Devin 现在能用 Gemini 3.7 Flash 了,重构时 diff 更干净,两周内打五折,想试试手就趁现在。
05:26
05:26官方一手@OpenAIDevs@OpenAIDevs
73°
OpenAI 为 Codex 和 ChatGPT 推出“Computer History”功能,用户可主动选择开启。开启后,模型能获取近期工作内容,实现从上次停下的地方继续、识别重复模式,并推荐合适的技能或定时任务。该公告由 OpenAI 开发者账号在 X 平台发布,目前尚未说明支持的具体平台和范围。
事件专题

推荐理由:OpenAI 给 Codex 和 ChatGPT 加了个“电脑历史”开关,开了之后 AI 能接着你上次的活儿干,还能自动安排重复任务。
05:20
05:20官方账号OpenAI@OpenAI
81°
ChatGPT桌面应用推出Computer History功能,可记录用户在电脑上跨应用和网站的活动。该功能使后续对话更个性化,减少用户重复解释。OpenAI官方推文显示该消息获得147088次浏览和175条评论。
事件专题

推荐理由:OpenAI给ChatGPT桌面版加了记忆功能,能记住你用过哪些应用和网站,下次对话不用再重讲一遍。
05:15
05:15官方账号OpenAI@OpenAI
72°
ChatGPT桌面应用(Mac版)新增Computer History功能,用户需在Settings → Integrations中手动启用。该功能目前面向Pro、Business和Enterprise用户全球推出。欧洲经济区、英国和瑞士的用户将在未来几周内获得访问权限。
事件专题

推荐理由:OpenAI给Mac版ChatGPT加了Computer History,去设置里的Integrations打开就能用,Pro用户现在就能试。
05:14
05:02
05:02Windsurf@windsurf_ai
76°
Cognition 宣布 Gemini 3.7 Flash 已集成至 Devin Desktop 和 Devin CLI。该模型在 FrontierCode 1.1 基准上达到 Claude Sonnet 5 级表现,成本不足后者一半。8月27日前使用可享五折优惠,并保留 Flash 系列的低延迟特性。
推荐理由:Devin 里现在有 Gemini 3.7 Flash 了,代码能力接近 Sonnet 5,价格便宜一半多,月底前还打五折,快去试试。
04:56
04:56Cognition@cognition_labs
73°
Cognition宣布Gemini 3.7 Flash现已接入编程智能体Devin。在FrontierCode 1.1基准上,Gemini 3.7 Flash达到Claude Sonnet 5水平,成本不到后者一半。该模型保持Flash系列的低延迟特性,Devin用户现在可以直接选用。

推荐理由:Devin现在能用Gemini 3.7 Flash了,跑FrontierCode 1.1和Claude Sonnet 5差不多,成本砍半还快,写代码可以试试。
03:01
02:58
02:58Harrison Chase@hwchase17
精选
LangChain 在 docs.langchain.com 更新了 managed deepagents 的官方文档。新文档将每个 agent 组件都定义为独立文件。开发者通过点击即可查看组件在仓库中的位置和具体代码。这样配置生产环境中的 agent 结构变得更加直观。

推荐理由:搞生产级 agent 的可以看看,LangChain 把 managed deepagents 的文档重写了,每个组件一个文件,点开就能看到代码在哪,省事。
02:45
02:45lmarena.ai@lmarena_ai
LMArena 官方发布了 Code Arena 的 WebDev 子榜与 Text Arena 的完整排行榜。两份榜单均托管在 arena.ai 的 leaderboard 页面下。该榜单基于用户对战投票,反映模型在网页开发与文本任务上的能力对比。具体模型排名可在对应页面查看。
推荐理由:LMArena 把 Code Arena(WebDev)和 Text Arena 的完整榜单放出来了,想看模型在网页开发和文本任务上的排名,直接点链接查。
02:37
02:37HeyGen@HeyGen_Official
LiveAvatar 宣布原生集成 Cartesia,已有语音代理无需重建即可获得实时人脸表现。官方提供三种方式将 Cartesia 的声音和代理接入 AI 头像。该功能让原本局限于文本框的对话代理,能够以虚拟面部进行实时交互。
推荐理由:如果你在用 Cartesia 搭语音代理,现在可以直接在 LiveAvatar 上给它加一张实时人脸,不用改代码。
02:28
02:20
02:20官方账号Perplexity@perplexity_ai
精选
Perplexity 发布了两批 Search SDK 更新,用于 Computer 环境。更新后,模型执行可靠性从 81.9% 提升到 92.6%。更高的可靠性让模型能更稳定地完成动作编排。该更新强调 SDK 的形态直接决定了模型的调用能力。

推荐理由:Perplexity 把 Search SDK 的执行可靠性从 81.9% 拉到 92.6%,做智能体编排的更稳了。
02:11
02:11bolt.new@boltdotnew
Bolt官方推特发布消息,宣称语音输入比打字更快。用户可以随意说出不成熟的想法,系统会自动清理。Bolt会去除“嗯”“啊”等语气词和重复内容。用户无需提前整理思路,可以全盘倒出。
推荐理由:Bolt出了个有意思的功能,动嘴说想法就行,它会自动帮你删掉“嗯啊”那些废话,适合懒得打长文的人。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。