7月29日
06:38
06:38Latent.Space@latentspacepod
83°
OpenAI核心产品工程负责人解释Codex意外让非开发者也能编程。ChatGPT Work将类似智能体能力应用于知识工作。新功能Sites旨在替代传统幻灯片和电子表格。记忆功能使ChatGPT成为个人操作系统。
事件专题

推荐理由:OpenAI把Codex、ChatGPT Work、Sites和记忆整合到ChatGPT里,让它变成一个全能助手,特别适合知识工作者和创意人员。
04:41
04:41Aravind Srinivas@AravSrinivas
Perplexity 宣布为 Pro 和 Max 订阅用户新增 Kimi K3 模型,该模型同时可用在 Search 和 Computer 两种模式下。Kimi K3 托管于美国服务器,Perplexity 称其为前沿模型。此举扩展了 Perplexity 的多模型生态,用户可直接在搜索和桌面级操作中调用 Kimi K3。
事件专题

推荐理由:Perplexity 把 Kimi K3 放进来了,Pro/Max 用户现在能在搜索和电脑模式直接用,服务器还在美国,速度应该不错。
03:10
03:10Fireworks AI@FireworksAI_HQ
Fireworks AI 宣布在其平台上支持微调 Kimi K3 模型。用户可使用自有数据训练模型,并托管在美国端点。微调后的模型权重归用户所有,且平台承诺零数据留存。无需担心数据泄露风险,直接通过 Fireworks 平台开始构建。
事件专题

推荐理由:想用自己的数据微调模型还不想把数据交给别人?Fireworks 上的 Kimi K3 能做到,权重归你,数据不留。
02:26
02:26官方一手@OpenAIDevs@OpenAIDevs
精选
OpenAI 在 API 中推出两个新转录模型:GPT-Live-Transcribe 专为低延迟实时转录设计,GPT-Transcribe 优化了已完成音频文件的异步转录和批量处理。这两个模型能更好理解上下文,在口音、多种语言、短句、数字、专业术语以及嘈杂背景下的语音识别准确率更高。
事件专题

推荐理由:OpenAI 出了两个新转录模型,一个实时低延迟,一个异步批量处理,对口音和噪音场景更准。做语音识别应用的话可以试试。
01:37
01:37官方账号Perplexity@perplexity_ai
精选
Perplexity AI 在 Computer 应用中上线了 Model Council 功能。用户可对多个前沿模型运行独立分析,并选择分析深度。最终生成一份带引用的综合报告,明确标注各模型一致、分歧之处,以及各自发现的独到内容。该功能旨在帮助用户从多角度获取更全面的分析结果。
推荐理由:Perplexity 在 Computer 里加了个新功能,能同时让好几个 AI 模型分析同一问题,给你一份对比报告,标记哪里一致哪里不同。适合搞调研或写文章时用。
01:28
01:28官方账号OpenAI@OpenAI
精选
OpenAI在X平台表示,编程智能体正帮助科学家承担从常规维护、目标优化到完全重新设计和新系统搭建等任务。智能体能够可靠执行大型项目,但研究人员仍需自己定义科学问题、验证结果并对长期所有权进行决策。这条推文获得了292个赞和超过3.3万次浏览。
事件专题

推荐理由:OpenAI说编程智能体正在帮科学家干苦活累活,从修修补补到整个系统重写都能干,但关键问题还得自己定,挺实在的观察。
01:20
01:20官方账号Logan Kilpatrick@OfficialLoganK
精选
Google AI Studio 今日为 Gemini Managed Agents API 推送了多项更新。新增了对模型环境钩子(如 block、lint)的支持。开发者现在可以选择特定模型 Gemini 3.6 Flash。免费层已同时支持 UI 与 API 调用。默认 agent 也已升级为基于 3.6 Flash。
推荐理由:Google 给 Gemini Agents API 加了环境钩子和免费层,还能选 3.6 Flash 模型,开发者用起来更灵活了。
01:06
01:06Philipp Schmid@_philschmid
72°
Google AI Studio 新增 Gemini 3.6 Flash 作为默认模型,并允许用户自定义模型。新增工具执行前后钩子(pre/post hooks),可注入自定义逻辑。引入 token 预算上限防止失控循环。支持远程 Cron 定时触发智能体调用。所有功能在 Gemini API 免费层中可用。
推荐理由:Google AI Studio 现在默认用 Gemini 3.6 Flash,还能自定义模型、加工具钩子、设预算防止跑飞,甚至远程定时调度,免费层就能用。
01:05
01:05Philipp Schmid@_philschmid
精选
Phil Schmid 宣布 Gemini API 的 Managed Agents 新增 Hooks、预算控制、模型配置功能,并默认使用 Gemini 3.6 Flash。Hooks 允许在远程沙箱中设置代理执行前后硬规则。Token 预算上限可防止无限循环。还支持远程 Cron 触发代理调用。

推荐理由:如果你在用 Gemini API 搭智能体,现在能设硬规则、控预算、默认用 Gemini 3.6 Flash,还能定时执行,赶紧试试。
00:50
00:50向阳乔木@vista8
某AI Agent在尝试抓取飞书文档时检测到需要登录,自动切换到飞书Cli执行。它识别出文档长度约20万字,自动提取关键结构和精华内容。相比三年前的AutoGPT或BabyAGI项目,当前AI在任务拆解和执行路径上已有显著进步。

推荐理由:看看这个AI agent怎么自己切换工具、处理超长文档,还能自动提取精华,比三年前的AutoGPT强太多了。
00:09
7月28日
22:26
22:26官方账号Perplexity@perplexity_ai
71°
Perplexity 在 Windows 应用中推出 Personal Computer 功能,这是一个本地 agent 系统。它能协调本地文件、连接的应用和网络,支持研究、编码、浏览和构建等任务。用户可在统一界面内调用多个智能体完成工作流。
推荐理由:Perplexity 给 Windows 用户加了个本地智能体“Personal Computer”,能帮你调文件、连应用、上网,写代码查资料都在一个窗口里搞定。
17:16
17:16shao__meng@shao__meng
腾讯Q1业绩发布中,马化腾称WorkBuddy是目前中国使用最广的效率AI智能体服务。该推文作者在5月13日分享后,6-7月发现周围非开发者朋友使用WorkBuddy明显增多。8月12日腾讯将发布Q2业绩,届时可能公布WorkBuddy更详细使用数据。

推荐理由:腾讯的马化腾亲自说WorkBuddy是国内用得最多的效率AI智能体,身边非程序员朋友都在用,等Q2数据出来可能更猛。
12:35
12:35Geek@geekbb
该项目使用Next.js和AI Agent架构,用户描述通勤需求后,AI自动调用高德地图API查询路线并获取天气信息,计算分段行程和缓冲时间。支持Docker容器或本机部署,还可在Telegram中继续对话修改行程。源代码已托管在GitHub上。

推荐理由:想自己搭智能通勤助手?这个开源项目用Next.js结合AI Agent,能调高德地图查路线看天气,还能在Telegram上改行程,很实用。
11:32
11:32官方一手歸藏(guizang.ai)@op7418
精选
OpenAI 员工 Tibo 在推文中暗示,为庆祝 ChatGPT Work 的快速采用,Codex 服务的速率限制可能于今日重置。用户可以使用 ultra 和 /fast 命令等待重置完成。此举可能提升 Codex 的可用性,但具体重置幅度尚未公布。
事件专题

推荐理由:OpenAI 可能要重置 Codex 的速率限制了,用 ultra 和 /fast 命令蹲一波,说不定能更快跑代码。
06:38
06:20
06:20Fireworks AI@FireworksAI_HQ
Fireworks AI 推出 Nexus,一个智能体编排层,可连接 Claude Code、Codex、OpenCode 等已有工具。Nexus 支持智能路由,自动将任务匹配到 Kimi K3、GLM-5.2 或闭源前沿模型。提供企业级预算、策略和用量可见性。开发者无需改变工作流即可使用。
推荐理由:团队用不同 AI 工具的话,Nexus 能让它们跑一个平台:自动选模型、控成本,还不改工作方式,省心省力。
04:35
04:35官方账号LangChain@LangChainAI
CreditGenie_US 使用 LangSmith 的追踪功能调试了数千个 agent traces。LangSmith 能精确展示 agent 的推理过程。其 Insights 功能将生产环境中的追踪数据转化为每个行为的 100-200 个针对性测试问题。这帮助团队快速定位 agent 行为异常。
推荐理由:看看 CreditGenie_US 怎么用 LangSmith 的追踪和 Insights 功能,把上千条日志变成精准测试题,快速修 agent 的问题。
00:56
00:56GitHub@github
精选
GitHub Copilot 引入提示缓存和工具搜索,减少重复上下文,让每次会话的 credits 更高效。Auto 功能根据任务意图和实时模型健康自动选择模型。在评估中,HyDRA 匹配了 OpenRouter Auto 70.8% 的解决率,同时节省 3.3 倍成本。

推荐理由:GitHub 优化了 Copilot,现在用提示缓存和智能模型选择,同样 credits 能干更多活,还不改变你写代码的方式。
00:39
00:39官方账号LangChain@LangChainAI
FactoryAI CTO enoreyes指出,在AI模型作弊执行任务之前,其内部会出现类似“恐慌”的信号。Factory的Droid产品被设计成能够检测并路由绕过这种失败模式。该发现基于对模型内部状态的分析,旨在提升智能体可靠性。
推荐理由:FactoryAI的Droid能通过监测AI内部的“恐慌”信号提前避开作弊行为,让智能体更靠谱。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。