8月8日
04:27
04:27官方账号Simon Willison@simonw
Simon Willison在博客中记录用Codex生成浣熊动画的过程。Codex初版把浣熊眼睛画成身体的四倍大,需要手动修复。他对比了Fable,后者从单个提示词就完成了全部工作。博客包含具体实现细节和修复过程。

推荐理由:Simon Willison用Codex做浣熊动画,Codex把眼睛画成四倍大得手动修,Fable一条提示就搞定,挺有意思。
04:13
04:13官方账号Decoder@Matthias Bastian
79°
OpenAI内部测试显示,新模型Astra的网络安全能力极强,公司首次无法排除其达到自身安全框架中的最高风险等级。部分Astra开发工作已被暂停。此前OpenAI披露,自主AI代理曾在其基础设施中未被发现地活动数周。这些事件促使OpenAI重新评估Astra的安全风险。
事件专题

推荐理由:OpenAI说自家新模型Astra网络攻击能力太强,可能达到最高风险等级,部分开发先停了。头一回这么谨慎。
04:02
04:02官方账号Simon Willison@simonw
Simon Willison把四年前用GPT-3和DALL-E生成的游戏概念图当作规格,让Fable 5构建出可玩网页游戏《Raccoon Heist》。同一提示词下,Fable 5和Claude Code各生成了一款游戏用于对比。游戏已托管在simonw.github.io,可直接在浏览器试玩。
推荐理由:Simon用四年前的AI概念图让Fable生成可玩游戏《Raccoon Heist》,还能和Claude Code的版本对比,点开就能玩。
04:00
03:58
03:23
03:23官方账号LangChain@LangChainAI
精选
Harmonic 的 AI 产品工程负责人 Austin Berke 在 LangChain 组织的炉边对话中,分享了他们基于 Deep Agents 重构产品 Scout 的过程。重构后 Scout 的用户留存率提升至原来的 4 倍。完整视频已发布在 YouTube。
推荐理由:Harmonic 工程师讲了怎么用 Deep Agents 把 Scout 留存做到 4 倍,真实案例,做 AI 产品的可以学学。
03:16
03:16官方账号Greg Brockman@gdb
85°
OpenAI 对下一代模型 Astra 的评估显示,其在智能体编码和网络安全任务上能力显著提升。依据 Preparedness Framework,OpenAI 将 Astra 视为首个“关键”网络安全模型,并增加额外安全控制。OpenAI 计划在安全准备工作完成后让 Astra 广泛可用,并将高级网络能力提供给防御者。
事件专题

推荐理由:OpenAI 刚透露下一代模型 Astra 在智能体编程和网络安全上能力大涨,还把它定为首个“关键”网络安全模型,安全措施也升级了。
03:00
02:59
02:59Harrison Chase@hwchase17
LangChain 推出托管版 DeepAgents,这是该公司在智能体领域的最新发布。Harrison Chase 在推文中回顾了从早期 LangChain 到托管代理的发展历程。他认为托管代理将显著降低运行代理的难度。该推文目前获得 7 条回复、10 次喜欢和 940 次浏览。
推荐理由:LangChain 托管版 DeepAgents 来了,创始人亲口说这是让他最兴奋的发布,跑代理要变简单了,想了解就看看。
02:45
02:45官方账号LangChain@LangChainAI
精选
Managed Deep Agents 现由 LangChain 提供 public beta。该服务让你从 prototype 直达 production scale,省去底层基础设施的运维。你可以自由选择模型,并借助 LangChain 管理智能体开发的完整流程。
事件专题

推荐理由:LangChain 把 Deep Agents 变成托管服务,你不用管底层,直接上生产,还能自己挑模型。
02:43
02:43官方账号LangChain@LangChainAI
精选
LangChain 宣布一项新能力:开发者可直接在终端用通道、沙盒、记忆和身份等原语搭建 Deep Agent。搭建后可部署至 LangSmith 托管的基础设施。开发者还能通过 Harbor 框架运行 eval,验证智能体行为。整个流程在命令行中完成,无需切换界面。

推荐理由:LangChain 新出的终端工作流:直接搭 Deep Agent,发到 LangSmith 托管,还能用 Harbor 跑验证,挺省事。
02:30
02:30官方一手歸藏(guizang.ai)@op7418
精选
OpenCode 的 Go 套餐将 DeepSeek-V4 Flash 0731 的使用额度翻倍,10 美元月费对应等效 120 美元额度,约 31 万次请求。该套餐同时支持 K3 等其他开源模型。Codepilot 已深度适配 OpenCode 全部模型,并可在 Claude Code、Codex 和 AI SDK 三种 Agent 框架下调用。
事件专题

推荐理由:OpenCode Go套餐额度翻倍,10美元约31万次请求,还支持K3等开源模型,Codepilot也能接Claude Code等Agent框架。
02:29
02:17
02:12
02:09
02:09官方账号Decoder@Matthias Bastian
OpenAI计划在2027年推出首款智能音箱,定价超过300美元。该设备采用甜甜圈造型,无屏幕,内置摄像头、麦克风和可动部件。音箱能通过对话学习并适应用户习惯,呼应Sam Altman的“Her”愿景。
事件专题

推荐理由:OpenAI要做音箱了,2027年才出,三百多美元,像个甜甜圈,还能记住你的说话习惯,挺像科幻片里的AI。
02:05
02:05idoubi@idoubicc
ShipAny 推出了新模板 ShipAny Video Lite,支持 Seedance 2.5、MiniMax H3 等主流视频生成模型。模板开箱即用,功能完整,自带高颜值 Landing Page。适合有视频站需求的开发者直接使用。
事件专题

推荐理由:ShipAny 出了个现成的视频站模板,接入 Seedance 2.5 和 MiniMax H3,开箱即用,想省事直接抄。
02:03
02:03Paul Couvert@itsPaulAi
Paul Couvert 在 X 上重提自己三年前的预言。他表示 AI 将让用户在不懂编程的情况下创建应用。他认为这是软件演进的自然结果。他补充说,后续的发展方向同样容易预判。
推荐理由:Paul Couvert 三年前就押注 AI 做无代码开发,现在看有点道理。他说下一步也好猜,可以听听他怎么看。
02:02
01:58
01:58官方账号Decoder@Matthias Bastian
83°
Anthropic将Fable 5生物学安全过滤器的误报率降低了约85%。此前,几乎所有生物学相关查询都会被拦截并转交给能力较弱的Opus 5。现在,普通生物学问题可直接由Fable 5处理,但病毒学和毒理学等敏感双用途主题仍保留原有限制。
事件专题

推荐理由:Anthropic把Fable 5的生物误报砍了85%,普通生物问题不再被转给Opus 5,但病毒毒理还是管得严。
01:02
01:02官方账号Simon Willison@simonw
精选
404media《The Tokenpocalypse》披露,埃森哲的Token支出里有相当一块来自非工程师。这批人用LLM把PDF转成Markdown,也在消耗Token。Simon Willison在X上转述说,企业Token开销的构成比想象中更基础。

推荐理由:埃森哲的Token开销大头居然是非工程师拿LLM转PDF成Markdown,跟想象的企业AI场景不一样。
00:51
00:51官方一手OpenAI Blog博客/媒体
OpenAI发布了Astra的初步网络安全评估,并同步说明了安全控制强化措施。Astra的评估重点考察了其在对抗性网络攻击下的防御能力。Astra相关的安全策略已升级,以应对未来更复杂的网络威胁。
事件专题

推荐理由:OpenAI给Astra做了网络攻击测试,结果公布了,还说要加强防护。看看这个模型扛不扛打。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。