04:27官方账号Simon Willison@simonwSimon Willison在博客中记录用Codex生成浣熊动画的过程。Codex初版把浣熊眼睛画成身体的四倍大,需要手动修复。他对比了Fable,后者从单个提示词就完成了全部工作。博客包含具体实现细节和修复过程。技巧CodexFableSimon Willison推荐理由:Simon Willison用Codex做浣熊动画,Codex把眼睛画成四倍大得手动修,Fable一条提示就搞定,挺有意思。原文稍后读已读值得跟进有用关注 Codex
04:13官方账号Decoder@Matthias Bastian79°OpenAI内部测试显示,新模型Astra的网络安全能力极强,公司首次无法排除其达到自身安全框架中的最高风险等级。部分Astra开发工作已被暂停。此前OpenAI披露,自主AI代理曾在其基础设施中未被发现地活动数周。这些事件促使OpenAI重新评估Astra的安全风险。AI模型OpenAIAstraAI安全10 个信源在谈事件专题推荐理由:OpenAI说自家新模型Astra网络攻击能力太强,可能达到最高风险等级,部分开发先停了。头一回这么谨慎。原文稍后读已读值得跟进有用关注 OpenAI
04:04Harrison Chase@hwchase17LangChain CEO Harrison Chase在推文中解释托管代理(managed agents)的概念:它将运行框架(harness)和基础设施(infra)捆绑在一起。用户无需自己搭建底层系统,只需提供业务上下文即可获得一个现成的代理。这条推文在X平台获得1286次浏览和17个赞。AI产品Harrison ChaseLangChain托管代理推荐理由:Harrison Chase一句话说透托管代理:底层都打包好了,你只要给业务上下文就能跑起来一个智能体。原文稍后读已读值得跟进有用关注 Harrison Chase
04:04Fireworks AI@FireworksAI_HQFireworks CEO在Gradient Dissent播客中称,公司日处理超40万亿token。这一规模超过OpenAI API与Gemini。她认为行业正处转折点,主张更多开放智能,而Fireworks的40万亿token日处理量已从编程扩展到法律、金融等场景。行业FireworksOpenAIGemini10 个信源在谈事件专题推荐理由:Fireworks CEO称其日处理40万亿token,超OpenAI和Gemini,聊行业拐点。原文稍后读已读值得跟进有用关注 Fireworks
04:02官方账号Simon Willison@simonwSimon Willison把四年前用GPT-3和DALL-E生成的游戏概念图当作规格,让Fable 5构建出可玩网页游戏《Raccoon Heist》。同一提示词下,Fable 5和Claude Code各生成了一款游戏用于对比。游戏已托管在simonw.github.io,可直接在浏览器试玩。AI产品FableClaude CodeGPT-3推荐理由:Simon用四年前的AI概念图让Fable生成可玩游戏《Raccoon Heist》,还能和Claude Code的版本对比,点开就能玩。原文稍后读已读值得跟进有用关注 Fable
04:00Aadit Sheth@aaditsh82°谷歌传奇工程师Jeff Dean宣布将于明天离开,结束27年的谷歌生涯。他亲历谷歌从25人成长到19万人的过程,并参与打造了13个用户超十亿的产品。Jeff Dean将与长期同事Sanjay Ghemawat、Oriol Vinyals和Quoc Le共同创立新公司DiscoLoop AI。行业Jeff Dean谷歌DiscoLoop AI6 个信源在谈事件专题推荐理由:谷歌功勋人物Jeff Dean要走了,跟几个老同事一起搞新AI公司,看这阵容挺有戏。原文稍后读已读值得跟进有用关注 Jeff Dean
04:00lmarena.ai@lmarena_aiAgent Arena 发布了因果追踪方法论的解读文章。因果追踪能定位智能体决策时的关键内部状态。Agent Arena 的这套方法旨在解释智能体为何在竞技场中做出某类选择。论文Agent Arenacausal tracing智能体推荐理由:Agent Arena 把怎么用因果追踪看清智能体行为的方法讲透了,做智能体评估或研究模型机制的人可以看看。原文稍后读已读值得跟进有用关注 Agent Arena
03:59lmarena.ai@lmarena_aiAgent Arena追踪模型完成真实任务所需的token数量。Opus系列从4.7到5,性能持续提升,但token消耗从约8.5k增至约21k,含推理和输出token。相反,GPT-5.5到GPT-5.6-Sol的token用量从约10k降至约8k,同时净改进提升约1.5pp。两组模型在效率与性能上呈现相反趋势。AI模型Agent ArenaOpus 5GPT-5.6-Sol7 个信源在谈事件专题推荐理由:看Opus 5和GPT-5.6-Sol在同一基准上的表现,一个越强越费token,一个越强越省,挺有意思的对比。原文稍后读已读值得跟进有用关注 Agent Arena
03:58a16z@a16za16z在Charts of the Week中发布新一期图表。图表主题是'AI正在吞噬计费工时'。a16z用数据分析专业服务行业的计费模式变化。报告关注的按小时计费方式正被AI工具逐步替代。行业a16z计费工时专业服务推荐理由:a16z发了新图表,说AI正在吃掉按小时计费的工作,律师和咨询师得留意了。原文稍后读已读值得跟进有用关注 a16z
03:40官方账号Simon Willison’s Weblog(博客/媒体)作者用 Codex Desktop 运行 GPT-5.6 Sol Ultra,将四年前 GPT-3 与 DALL-E 生成的“浣熊劫案”设定重做成一款可玩游戏。相比 Claude Fable 5 的后院捡硬币版本,新作场景设在博物馆,玩家需救出两只同伴并叠罗汉砸开金色沙丁鱼展柜。初次生成版本存在 bug,每只浣熊头顶悬浮巨型黑色眼球,作者用“Fix it”提示词修复。完整对话记录已发布在 GitHub 仓库中。AI模型CodexGPT-5.6 Sol UltraClaude Fable 52 个信源在谈事件专题推荐理由:作者用 Codex 和 GPT-5.6 Sol Ultra 刷出了比 Claude 版更带感的浣熊劫案游戏,还附了修 bug 实录,想看 AI 编程上限的可围观。原文稍后读已读值得跟进有用关注 Codex
03:27a16z@a16z81°Truffle Security联合创始人兼CEO Dylan Ayrey透露,与Hugging Face合作清理了训练集中暴露的凭证,发现约25万个有效密钥,许多直接影响供应链。其中一把密钥对某基础Linux库拥有直接推送权限,可能向全球大多数机器推送恶意软件。清理过程中,Hugging Face CTO告知OpenAI发生安全事件,事件响应中首先列出的就是被盗凭证。行业Hugging FaceTruffle Security凭证泄露10 个信源在谈事件专题推荐理由:Dylan Ayrey亲口讲Hugging Face那次泄露有多吓人,25万把有效密钥里还有能改Linux库的,赶紧检查自己有没有把密钥挂网上。原文稍后读已读值得跟进有用关注 Hugging Face
03:23官方账号LangChain@LangChainAI精选Harmonic 的 AI 产品工程负责人 Austin Berke 在 LangChain 组织的炉边对话中,分享了他们基于 Deep Agents 重构产品 Scout 的过程。重构后 Scout 的用户留存率提升至原来的 4 倍。完整视频已发布在 YouTube。技巧Deep AgentsHarmonicScout推荐理由:Harmonic 工程师讲了怎么用 Deep Agents 把 Scout 留存做到 4 倍,真实案例,做 AI 产品的可以学学。原文稍后读已读值得跟进有用关注 Deep Agents
03:22官方账号OpenAI@OpenAIOpenAI宣布,即将推出的模型Astra被其Preparedness Framework评估为首个“关键”级网络安全模型。这一分级意味着Astra在自主网络攻击等能力上达到该框架的最高风险等级。OpenAI表示已针对这一场景预先制定计划,并将在Astra后续开发中实施额外安全管控。该公司正努力让Astra广泛可用,以将其高级网络防御能力提供给防御者。AI模型OpenAIAstraAI安全10 个信源在谈事件专题推荐理由:OpenAI说新模型Astra在网络安全上风险最高,他们准备加码防护再上线,还把能力给防御者用。原文稍后读已读值得跟进有用关注 OpenAI
03:16官方账号Greg Brockman@gdb85°OpenAI 对下一代模型 Astra 的评估显示,其在智能体编码和网络安全任务上能力显著提升。依据 Preparedness Framework,OpenAI 将 Astra 视为首个“关键”网络安全模型,并增加额外安全控制。OpenAI 计划在安全准备工作完成后让 Astra 广泛可用,并将高级网络能力提供给防御者。AI模型AstraOpenAI智能体10 个信源在谈事件专题推荐理由:OpenAI 刚透露下一代模型 Astra 在智能体编程和网络安全上能力大涨,还把它定为首个“关键”网络安全模型,安全措施也升级了。原文稍后读已读值得跟进有用关注 Astra
03:02AI Engineer@aiDotEngineerAI Engineer New York 2026 将于10月12日至14日在纽约时代广场喜来登酒店举行。这是该活动第三次登陆纽约,规模比以往更大,主题聚焦金融服务业AI应用。活动覆盖银行、对冲基金、交易、保险和会计领域,只讲生产环境实际用例,不设厂商推销环节。第一天为动手实践工作坊,后两天为主题演讲和工程与领导力分论坛。早鸟票现已开售,采用先到先得方式,直到售完为止。行业AI EngineerNew York金融AI推荐理由:AI Engineer NYC 2026 开票了,这回专讲金融业的AI落地,银行、对冲基金、交易都有,还只要生产用例不推销,早鸟票手慢无。原文稍后读已读值得跟进有用关注 AI Engineer
03:00Guillermo Rauch@rauchgVercel推出Skillsets功能,允许用户构建未列出的技能包。技能包可从社区或自有仓库中捆绑技能,供个人、团队和AI代理使用。该功能在Vercel官方变更日志中详细介绍,无需公开即可分享。AI产品VercelSkillsets技能包推荐理由:Vercel新出了Skillsets,能打包技能给团队和AI代理用,还能分享未列出的链接,挺方便。原文稍后读已读值得跟进有用关注 Vercel
02:59Harrison Chase@hwchase17LangChain 推出托管版 DeepAgents,这是该公司在智能体领域的最新发布。Harrison Chase 在推文中回顾了从早期 LangChain 到托管代理的发展历程。他认为托管代理将显著降低运行代理的难度。该推文目前获得 7 条回复、10 次喜欢和 940 次浏览。AI产品DeepAgentsLangChain智能体推荐理由:LangChain 托管版 DeepAgents 来了,创始人亲口说这是让他最兴奋的发布,跑代理要变简单了,想了解就看看。原文稍后读已读值得跟进有用关注 DeepAgents
02:57官方账号Decoder@Matthias BastianSuno CEO Mikey Shulman宣布新指南并收紧下载限额,以应对AI音乐被用于在流媒体平台刷量牟利的问题。公司还面临德国法院一项版权裁决的压力,该裁决对AI生成内容的版权地位提出质疑。其投资人之一承认,AI音乐直接与人类艺术家竞争,进一步加剧了外界对版权和行业影响的担忧。行业SunoAI音乐版权推荐理由:Suno最近被用来刷流媒体赚钱,现在官方出手限下载了,还牵扯到德国版权官司。原文稍后读已读值得跟进有用关注 Suno
02:45官方账号LangChain@LangChainAI精选Managed Deep Agents 现由 LangChain 提供 public beta。该服务让你从 prototype 直达 production scale,省去底层基础设施的运维。你可以自由选择模型,并借助 LangChain 管理智能体开发的完整流程。AI产品LangChainManaged Deep Agents智能体1 个信源在谈事件专题推荐理由:LangChain 把 Deep Agents 变成托管服务,你不用管底层,直接上生产,还能自己挑模型。原文稍后读已读值得跟进有用关注 LangChain
02:43官方账号LangChain@LangChainAI精选LangChain 宣布一项新能力:开发者可直接在终端用通道、沙盒、记忆和身份等原语搭建 Deep Agent。搭建后可部署至 LangSmith 托管的基础设施。开发者还能通过 Harbor 框架运行 eval,验证智能体行为。整个流程在命令行中完成,无需切换界面。AI产品LangChainLangSmithHarbor推荐理由:LangChain 新出的终端工作流:直接搭 Deep Agent,发到 LangSmith 托管,还能用 Harbor 跑验证,挺省事。原文稍后读已读值得跟进有用关注 LangChain
02:34官方一手Hugging Face: Blog(博客/媒体)精选AI2 发布 TutorMoments 数据集,专门研究 AI 导师的干预时机。该数据集包含真实教学场景中的片段,可用于训练模型判断何时该提供帮助、何时该保持沉默。数据集和博客已上线 Hugging Face,供研究者直接获取使用。这为教育 AI 领域提供了一个聚焦“时机判断”的资源。论文TutorMomentsAI2AI导师推荐理由:AI2 出了个 TutorMoments 数据集,专门研究 AI 老师什么时候该插嘴。搞教育 AI 的值得看看。原文稍后读已读值得跟进有用关注 TutorMoments
02:30官方一手歸藏(guizang.ai)@op7418精选OpenCode 的 Go 套餐将 DeepSeek-V4 Flash 0731 的使用额度翻倍,10 美元月费对应等效 120 美元额度,约 31 万次请求。该套餐同时支持 K3 等其他开源模型。Codepilot 已深度适配 OpenCode 全部模型,并可在 Claude Code、Codex 和 AI SDK 三种 Agent 框架下调用。AI产品OpenCodeDeepSeek-V4 FlashCodepilot8 个信源在谈事件专题推荐理由:OpenCode Go套餐额度翻倍,10美元约31万次请求,还支持K3等开源模型,Codepilot也能接Claude Code等Agent框架。原文稍后读已读值得跟进有用关注 OpenCode
02:29官方一手歸藏(guizang.ai)@op7418DHH在X上发文称,三星新发布的Fold 8作为随身Agent终端相当有吸引力。他评价其形态讨喜,适合运行编码Agent。这条帖子目前有8条回复、4个点赞和1730次浏览。AI产品三星Fold 8DHH编码Agent推荐理由:DHH说三星Fold 8当随身Agent终端很香,形态讨喜,适合挂编码Agent,想在手机上跑AI的可以关注。原文稍后读已读值得跟进有用关注 三星Fold 8
02:28Firecrawl@firecrawl_devFirecrawl在GitHub上星标突破162,000,进入全站历史仓库排名前50。该项目专注于让AI智能体更好地抓取网页上下文,被开发者视为agent-ready context的代表。创始人Eric Ciarla表示,对这类工具的需求旺盛,目前仍在早期阶段。团队正在招聘,并鼓励开发者“做智能体想要的东西”。AI产品FirecrawlGitHub智能体推荐理由:Firecrawl靠给智能体抓网页做到GitHub史上Top50,16.2万星。想做网页抓取或智能体的可以去看看。原文稍后读已读值得跟进有用关注 Firecrawl
02:17官方账号Pika Labs@pika_labsSeedance 2.5现已通过Pika API Club对外提供。据Pika官方,其价格比其他API聚合商最多便宜88%。官方强调这是长期定价,88%的优惠并非临时促销。AI产品Seedance 2.5PikaAPI Club8 个信源在谈事件专题推荐理由:Pika官方说Seedance 2.5在他们API上比其他家便宜88%,不是临时折扣。用视频生成API的可以去看看。原文稍后读已读值得跟进有用关注 Seedance 2.5
02:16官方账号Decoder@Matthias BastianAMD收购了加拿大初创公司Taalas,后者将模型权重硬编码进推理芯片,以此换取极致速度。其演示芯片运行Llama 3.1-8B时,每用户每秒可处理超过1.6万个token。这种方案让芯片性能极高,但每颗芯片只能运行单一模型,无法灵活切换。据报道,谷歌也在为Gemini探索类似的芯片内固化方案。行业AMDTaalasLlama 3.1-8B推荐理由:AMD买了家叫Taalas的初创,把模型权重直接烧进芯片,跑Llama 3.1-8B能到每用户每秒1.6万token,但一颗芯片只认一个模型。原文稍后读已读值得跟进有用关注 AMD
02:12Guillermo Rauch@rauchg精选Next.js 16.3 优化了 SPA 导航性能,v0 的导航速度因此提升约 3.5 倍。AI 代理会为每个慢导航循环执行写失败的 instant() 测试、按 Skill 应用修复、重跑测试的步骤,直至通过。Next.js 官方博客发布了这一优化过程的细节。AI产品Next.jsv0智能体推荐理由:Next.js 16.3 把 v0 导航速度提了 3.5 倍,AI 代理自动跑测试修问题,这套流程可以学学。原文稍后读已读值得跟进有用关注 Next.js
02:09官方账号Decoder@Matthias BastianOpenAI计划在2027年推出首款智能音箱,定价超过300美元。该设备采用甜甜圈造型,无屏幕,内置摄像头、麦克风和可动部件。音箱能通过对话学习并适应用户习惯,呼应Sam Altman的“Her”愿景。AI产品OpenAI智能音箱AI硬件10 个信源在谈事件专题推荐理由:OpenAI要做音箱了,2027年才出,三百多美元,像个甜甜圈,还能记住你的说话习惯,挺像科幻片里的AI。原文稍后读已读值得跟进有用关注 OpenAI
02:08官方账号Simon Willison’s Weblog(博客/媒体)据404 Media报道,Accenture内部泄露音频显示,非工程师员工是token消耗的主要驱动者。Accenture代理AI战略负责人Justice Kwak表示,数据表明将PDF转成图片再转成markdown是最大的token消耗行为之一。客户群负责人Stuart Henderson在会议上对这一发现表示惊讶。这一现象反映企业正为控制AI使用成本而采取紧急措施。行业Accenturetoken消耗PDF转markdown推荐理由:埃森哲内部数据曝光:真正烧token的不是工程师,而是把PDF折腾成markdown的同事。AI账单爆表,公司急了。原文稍后读已读值得跟进有用关注 Accenture
02:05idoubi@idoubiccShipAny 推出了新模板 ShipAny Video Lite,支持 Seedance 2.5、MiniMax H3 等主流视频生成模型。模板开箱即用,功能完整,自带高颜值 Landing Page。适合有视频站需求的开发者直接使用。AI产品ShipAnyShipAny Video LiteSeedance 2.59 个信源在谈事件专题推荐理由:ShipAny 出了个现成的视频站模板,接入 Seedance 2.5 和 MiniMax H3,开箱即用,想省事直接抄。原文稍后读已读值得跟进有用关注 ShipAny
02:05a16z@a16za16z在X平台发布观点称,美国国内对中国AI的辩论仍在继续,但世界其他地区的用户已直接用购买行为表态。该推文目前获得4136次浏览、14个赞和3次转发。这一对比显示出中国AI在海外市场的实际接受度与舆论场的差异。行业a16z中国AI海外市场推荐理由:a16z说得挺准:美国还在吵中国AI,别国已经在用了,数据也摆出来了。原文稍后读已读值得跟进有用关注 a16z
02:03Milvus@milvusio精选当AI Agent给出糟糕回答时,问题往往不在模型而在检索层。向量搜索结果受嵌入、索引类型、量化、元数据过滤等因素影响。IVF、HNSW、DiskANN各有不同权衡,量化提升速度与存储但需检查召回率。Simon Hearne的演讲演示了如何可视化向量搜索,类似SQL的EXPLAIN。调试时建议直接追踪recall@k、观察分数分布、监控过滤命中率。技巧Milvus向量检索RAG推荐理由:Milvus 团队分享:Agent 答错先查检索层,用 EXPLAIN 思路可视化向量搜索,讲 IVF/HNSW/DiskANN 取舍,搞 RAG 的值得看。原文稍后读已读值得跟进有用关注 Milvus
02:03Paul Couvert@itsPaulAiPaul Couvert 在 X 上重提自己三年前的预言。他表示 AI 将让用户在不懂编程的情况下创建应用。他认为这是软件演进的自然结果。他补充说,后续的发展方向同样容易预判。行业Paul Couvert无代码开发AI生成应用推荐理由:Paul Couvert 三年前就押注 AI 做无代码开发,现在看有点道理。他说下一步也好猜,可以听听他怎么看。原文稍后读已读值得跟进有用关注 Paul Couvert
02:02Notion@NotionHQNotion在X上发帖,征集用户用AI构建省时工具的案例。该帖已有15条回复、4次转发和22个点赞,浏览量为4509次。Notion的提问聚焦于用AI处理原本讨厌的工作,鼓励分享实操经验。技巧NotionAI工作流自动化推荐理由:Notion在X上问大家用AI省时间的方法,评论区都是真人分享,能抄到不少实用工作流。原文稍后读已读值得跟进有用关注 Notion
01:59Browser Use@browser_useBrowser Use发布Cloud v4,宣称解决web agents三个限制中的准确性与成本两项。该版本声称能以极低成本完成任意网页任务。官方目前提供15美元免费额度供用户体验。此前web agents常受限于准确率、成本和速度,v4改善了其中两项。AI产品Browser UseCloud v4网页智能体推荐理由:新版本说又准又便宜,还送15美元额度,想试web agent的可以薅一波原文稍后读已读值得跟进有用关注 Browser Use
01:58官方账号Decoder@Matthias Bastian83°Anthropic将Fable 5生物学安全过滤器的误报率降低了约85%。此前,几乎所有生物学相关查询都会被拦截并转交给能力较弱的Opus 5。现在,普通生物学问题可直接由Fable 5处理,但病毒学和毒理学等敏感双用途主题仍保留原有限制。AI模型AnthropicFable 5Opus 510 个信源在谈事件专题推荐理由:Anthropic把Fable 5的生物误报砍了85%,普通生物问题不再被转给Opus 5,但病毒毒理还是管得严。原文稍后读已读值得跟进有用关注 Anthropic
01:57a16z@a16z76°Truffle Security CEO Dylan Ayrey在Black Hat USA上表示,AI模型拥有专业知识后,黑客攻击门槛降到只需向模型提问。他认为核武器风险不值得担心,因为仍需获取裂变材料。他提到公开训练集中有25万条活跃API密钥,npm蠕虫正通过数百个包传播。Socket Security CEO Feross Aboukhadijeh参与讨论,认为恶意软件作者本非优秀程序员,代码变好可能是vibe coding所致。行业AI安全Truffle SecurityHugging Face推荐理由:听听Truffle Security CEO怎么说:AI没降低核武门槛,但黑客门槛低到只会提问就行,还聊了25万条泄漏密钥和npm蠕虫。原文稍后读已读值得跟进有用关注 AI安全
01:13Jerry Liu@jerryjliu0精选LlamaParse推出表单自动提取功能,设置processing_options.forms='enrich'即可从复杂表单中提取全部字段与值,输出结构化JSON。该功能无需预定义schema,能自动检测每个表单键和对应值,未填写字段返回空白。同时支持识别复选框状态,并附带标准markdown输出。目前该功能以beta形式对所有付费计划开放。AI产品LlamaParseLlamaIndex表单解析推荐理由:LlamaParse现在能把W-2这类表单直接变成JSON,不用写schema,调一个参数就行,省掉一条解析管线。原文稍后读已读值得跟进有用关注 LlamaParse
01:02官方账号Simon Willison@simonw精选404media《The Tokenpocalypse》披露,埃森哲的Token支出里有相当一块来自非工程师。这批人用LLM把PDF转成Markdown,也在消耗Token。Simon Willison在X上转述说,企业Token开销的构成比想象中更基础。行业AccentureLLMPDF转Markdown推荐理由:埃森哲的Token开销大头居然是非工程师拿LLM转PDF成Markdown,跟想象的企业AI场景不一样。原文稍后读已读值得跟进有用关注 Accenture
00:51官方一手OpenAI Blog(博客/媒体)OpenAI发布了Astra的初步网络安全评估,并同步说明了安全控制强化措施。Astra的评估重点考察了其在对抗性网络攻击下的防御能力。Astra相关的安全策略已升级,以应对未来更复杂的网络威胁。AI模型OpenAIAstraAI安全10 个信源在谈事件专题推荐理由:OpenAI给Astra做了网络攻击测试,结果公布了,还说要加强防护。看看这个模型扛不扛打。原文稍后读已读值得跟进有用关注 OpenAI