08:46IT之家(博客/媒体)81°ChatGPT 发生全球范围服务中断,用户无法登录和访问聊天界面,故障始于美国东部时间19日晚8点,波及全球多地;受影响的网站chatgpt.com新用户注册与账号登录功能失效,同时OpenAI代码平台Codex也受影响;OpenAI在官方状态页公示故障,团队正推进修复方案。AI模型ChatGPTOpenAIcodex10 个信源在谈事件专题推荐理由:OpenAI说ChatGPT服务突然全区域故障,正在修复,这次影响比之前广,等他们弄好后就能用了。原文稍后读已读值得跟进有用关注 ChatGPT
05:26Guillermo Rauch@rauchgVercel Agent 能在 Slack 线程中添加,带有完整生产上下文;可添加至任意线程执行操作;支持创建计划和 PR 操作;能回滚部署并更新代码。AI产品VercelSlack智能体5 个信源在谈事件专题推荐理由:Vercel 新功能,Agent 加到 Slack 带完整上下文,操作比普通工具方便。原文稍后读已读值得跟进有用关注 Vercel
03:31官方账号Cursor@cursor_ai精选Cursor这款AI模型现调整为在操作过程中等待下一个工具调用指令,不再中途终止动作。该功能更新后支持连续的工具调用序列,提升交互完整性。与之前版本相比,现在可在完成整个工具调用后才切换到下一步操作。AI模型Cursor工具调用提示词工程6 个信源在谈事件专题推荐理由:Cursor这AI调整了工具调用流程,现在等下个工具指令才结束动作,比之前更顺畅啦。原文稍后读已读值得跟进有用关注 Cursor
03:31官方账号Cursor@cursor_aiCursor发布了/goal指令功能,可让代理朝着长期目标持续工作直至完全达成。该功能通过指定明确目标,为代理提供清晰工作方向。与旧版操作相比,新功能增强了任务执行的持续性。AI模型cursor智能体指令功能6 个信源在谈事件专题推荐理由:cursor推出了/goal指令,能让你给代理设定长期目标,比之前方法让任务更持续地推进。原文稍后读已读值得跟进有用关注 cursor
03:11Harrison Chase@hwchase17LangChain 与 PrimeIntellect 等公司将举办网络研讨会,讲解如何通过自动化提升代理改进循环;重点围绕评估和环境工程这两个关键环节展开分享;参与者可学习到更高效的代理流程优化方法。技巧LangChainPrimeIntellectbaseten推荐理由:LangChain他们搞的网络研讨会,讲怎么自动优化代理流程,比普通方法更管用,你去听听吧。原文稍后读已读值得跟进有用关注 LangChain
02:55elvis@omarsar0TrueFoundry 推出的这个仓库,能帮助开发者将 agent 从原型阶段顺利过渡到生产环境,该项目目前已有 485 次浏览量。该仓库专注于 agent 部署流程的构建,与普通原型项目相比,在流程系统化方面更具优势。开发者可借助该仓库学习 agent 全流程部署方法,目前已有 1 个点赞互动。技巧TrueFoundryagent部署智能体推荐理由:老铁,TrueFoundry 这个仓库能帮你把 agent 从原型弄到生产,和一般项目不一样,值得看看~原文稍后读已读值得跟进有用关注 TrueFoundry
02:51elvis@omarsar0TrueForge 是 TrueFoundry 推出的开源代理 harness,支持运行 OpenAI、Anthropic、Kimi 等多种模型;在 14 任务企业代理基准中,其准确性匹配 Claude Managed Agents,成本降低约 30%;本地部署便捷,支持 sandboxed code 执行。AI产品TrueForgeTrueFoundryOpenAI10 个信源在谈事件专题推荐理由:TrueFoundry 推出了 TrueForge,这是个开源代理 harness,能跑多种模型,和企业版比成本更低还能自己部署。原文稍后读已读值得跟进有用关注 TrueForge
02:41lmarena.ai@lmarena_aiAgent Arena推出的Pareto前沿平台上,Claude Opus 5(High)在真实代理任务中表现领先,提升+12.34%;该平台对比了各模型成本与性能,@OpenAI的GPT 5.5(High)表现突出,提升+7.75%;参与对比的多款知名模型包括Kimi K3(Max)和Groq 4.5等,帮助用户了解不同模型差异。AI模型Claude Opus 5Kimi K3GPT 5.510 个信源在谈事件专题推荐理由:Agent Arena发布了Pareto前沿平台,能查各模型做真实任务里的表现,像 Claude 和 GPT 这些对比后就知道哪个更划算。原文稍后读已读值得跟进有用关注 Claude Opus 5
02:15官方账号LangChain@LangChainAI精选LangChain 探索让代理评估自动化,借助仓库上下文和生成轨迹构建评估系统。该方案支持在可重复的环境里测试这些评估。整个过程还能让开发者持续了解情况。技巧LangChain智能体提示词工程推荐理由:LangChain 发了这活动,教大家用仓库和轨迹做代理评估,比传统方法更高效,想学自动化评估的去参加。原文稍后读已读值得跟进有用关注 LangChain
01:36Harrison Chase@hwchase17YouTube推出的‘Managed Deep Agents’系列播放列表包含六部视频,第一部为介绍环节,后续视频分别讲解概念、快速开始、操作指南、技能及工具等内容,全面覆盖管理深代理的核心知识体系。技巧Managed Deep Agents播放列表智能体推荐理由:YouTube出了个‘Managed Deep Agents’系列播放列表,分步讲管理深代理的事,每个视频讲不同模块,比自己查资料方便。原文稍后读已读值得跟进有用关注 Managed Deep Agents
01:25官方账号NVIDIA AI@NVIDIAAI74°英伟达对超300项验证技能开展基准测试,以相同任务、模型和设置对比有无技能的代理表现。在多项真实任务基准中,带技能的代理正确率提升41个百分点。与无技能代理相比,带技能代理效率提升35个百分点。AI模型NVIDIASkillsBenchmark7 个信源在谈事件专题推荐理由:英伟达测试超300项技能,对比后可知技能对代理帮助大小, 和无技能代理比效果不同, 值得去了解。原文稍后读已读值得跟进有用关注 NVIDIA
00:16小互@imxiaohuOJO作为首款设计Agent团队工作空间,可组建专属设计团队并添加专业技能,将创意转化为产品策略等产品文档;该工作空间能在单一可编辑画布上完成从想法到可上线设计的全流程;与普通设计工具对比,其在设计协作效率上有显著优势。AI产品OJO设计工具团队协作推荐理由:OJO推出了设计Agent团队工作空间,能帮你组建团队加技能,把创意转成产品文档,和普通设计工具比更高效做全流程设计。原文稍后读已读值得跟进有用关注 OJO
23:55elvis@omarsar0Michael Matloka已加入Viktor公司担任产品工程师。他是PostHog公司的第5位员工,曾负责构建PostHog AI产品。Matloka在agent harnesses领域有独到见解,被认为是顶尖的产品工程师。行业Michael MatlokaPostHogViktor推荐理由:Viktor请来了PostHog的前5号员工,这位AI产品专家会给团队带来什么新变化?原文稍后读已读值得跟进有用关注 Michael Matloka
23:55Amjad Masad@amasad72°Replit与OpenAI合作推出免费模式,使用GPT-5.6 Luna模型。该模式旨在解决智能体降低软件成本却提高编程成本的问题。Replit Free Mode通过OpenAI技术让智能体更易于获取。AI产品ReplitOpenAIGPT-5.610 个信源在谈事件专题推荐理由:Replit和OpenAI联手推出免费编程模式,GPT-5.6 Luna让智能体更亲民。原文稍后读已读值得跟进有用关注 Replit
23:51elvis@omarsar0TrueFoundry发布开源智能体工具,针对开源模型GLM-5.2进行了优化。该工具可降低GLM-5.2使用成本75%,同时支持其他前沿模型。用户反馈显示该工具性能良好,已开放早期访问权限。AI产品TrueFoundryGLM-5.2智能体推荐理由:TrueFoundry出了个开源智能体工具,能让GLM-5.2成本降75%,还支持其他前沿模型,值得一试。原文稍后读已读值得跟进有用关注 TrueFoundry
22:48IT之家(博客/媒体)启境汽车发布GX7阔五座SUV内饰设计,搭载华为鸿蒙座舱HarmonySpace 6系统。新车配备十块屏幕,包括双15.6英寸车载智慧双联屏和88英寸大画幅增强现实抬头显示。后排座椅可180°放平形成纯平大床,拥有1096mm腿部空间和1070mm头部空间。AI产品启境GX7HarmonySpace华为鸿蒙座舱推荐理由:启境GX7内饰首秀,华为鸿蒙座舱十屏配置,后排能变'大床',车载冰箱还能调温。原文稍后读已读值得跟进有用关注 启境GX7
22:46Yangyi@YangyixxxxWorkbuddy能主动生成框架图和流程图帮助用户理解复杂概念。相比之下,其他AI助手如NewMax更多使用markdown输出纯文本线框示意图。这一功能差异体现了Workbuddy在可视化辅助方面的优势。AI产品NewMaxWorkbuddy智能体推荐理由:看了Workbuddy的自动生成流程图功能,比NewMax直观多了!原文稍后读已读值得跟进有用关注 NewMax
22:46量子位@量子位的朋友们IDC发布2026年中国AI50强榜单,360凭借企业级智能体与AI安全全栈布局成功入选。360的智能体技术与安全能力形成双轮驱动模式,成为AI产业代表企业。该榜单评估了中国AI企业的综合实力与创新能力。行业IDC360智能体推荐理由:看看360怎么靠智能体+安全双轮驱动,杀进IDC中国AI50强的。原文稍后读已读值得跟进有用关注 IDC
22:43eric zakariasson@ericzakariassonGrok bot本周展示了8个有趣用例。用户Yun-Ta Tsai将Grok连接到真空机器人,通过文本指令控制清洁。Grok @bot现已支持与@maticrobots交互,用户可随时随地发送清洁指令。AI产品GrokX智能体推荐理由:Grok bot本周有8个实用用例,特别是能控制真空机器人,比普通聊天助手更实用。原文稍后读已读值得跟进有用关注 Grok
22:42AI Will@FinanceYF5epochai的新模型版本在GLUE基准测试中获得优异表现;与上一版本相比,该模型在多语言任务中的准确率提升了15%;epochai团队强调此次更新聚焦模型推理能力的优化。AI模型epochai智能体推理模型推荐理由:试试epochai的新模型吧,它在GLUE基准比之前版好15%,多语言处理更顺了,值得看看。原文稍后读已读值得跟进有用关注 epochai
22:42Aadit Sheth@aaditsh该推特用户表示若想模仿大众表达且不被重视,应使用AI写作;其分享的思路能帮助快速完成写作任务;这种方式与纯手工书写相比,在效率上有明显优势。技巧AI写作智能体写作技巧推荐理由:朋友说那个推特上的人说的用AI写作的方法,能帮你很快写出普通风格文字,和用手写比起来方便多了。原文稍后读已读值得跟进有用关注 AI写作
22:41AI Will@FinanceYF5精选Anthropic 公司发布技术报告,报告中呈现了其AI模型在智能体开发方面的最新成果;同时该公司开源了提示词数据集,为开发者提供实践参考;该举措让开发者能够对比 Anthropic 与行业同类项目的差异。论文Anthropic智能体提示词工程10 个信源在谈事件专题推荐理由:Anthropic 发布技术报告和开源提示词,对做智能体开发的伙伴有帮助,比普通AI工具更专业些。原文稍后读已读值得跟进有用关注 Anthropic
22:38官方账号Clement Delangue@ClementDelangue2018年,HF为青少年开发专属聊天机器人,同时OpenAI推进自身核心项目。2026年,双方项目方向出现逆转,HF转向OpenAI类项目,OpenAI则聚焦青少年聊天机器人。行业HFOpenAIChatbot10 个信源在谈事件专题推荐理由:朋友说HF和OpenAI这次项目方向调换了,HF做类似OpenAI的项目,OpenAI做青少年聊天机器人,和之前比方向完全变了,值得了解下~原文稍后读已读值得跟进有用关注 HF
22:37IT之家(博客/媒体)小米新一代人形机器人在2026世界机器人博览会上亮相,其与观众互动视频显示,由大模型驱动实现自主理解动作;从递花、握手等互动场景可知,机器人可自主判断并完成动作;8月20日起展台开放,观众将体验该功能。AI产品小米新一代人形机器人人形机器人智能体推荐理由:小米发布了人形机器人互动视频,用大模型让人机互动更自然,和普通机器人比能自主理解动作。原文稍后读已读值得跟进有用关注 小米新一代人形机器人
12:33Geek@geekbb一款新工具可将Markdown一键转换为全内联样式的HTML。转换后的内容可直接粘贴到微信公众号编辑器且格式不会错乱。该工具专为AI Agent设计,可直接调用。AI产品Markdown微信公众号HTML推荐理由:有人做了个Markdown转微信HTML工具,解决了格式错乱问题,AI Agent还能直接调用。原文稍后读已读值得跟进有用关注 Markdown
12:32AI Will@FinanceYF5Andrew Ng发布了AI工程核心技能地图。这份地图详细列出了AI工程师需要掌握的关键技能。该技能地图涵盖了从基础到高级的AI工程知识体系。AI产品Andrew NgAI工程技能地图推荐理由:吴恩达出了AI工程技能地图,想入行或提升的快看看,比普通课程更系统全面。原文稍后读已读值得跟进有用关注 Andrew Ng
11:47elvis@omarsar0Grok Bot是智能体领域的重要分水岭。berd团队开源了其内部最常用的工具berd,用户可自带模型和工具。该平台将工作与上下文整合在一个不受限制的环境中。用户可以在berd.xyz体验这一智能体团队构建工具。AI产品berdGrok Bot智能体推荐理由:berd开源了他们的智能体平台,让你能自带模型构建团队,和Grok Bot一起改变AI交互方式。原文稍后读已读值得跟进有用关注 berd
11:45官方一手Pandaily@contact@pandaily.com (Pandaily)8月17日,支付宝举办首届AI生态大会,蚂蚁集团CEO韩益新预测超级智能体将在6-12个月内爆发。支付宝推出以小宝超级智能体为核心的全栈智能体商务基础,已连接5个手机品牌和16家主流汽车制造商。同时发布了中国首个AHA(智能体中心接入)多智能体跨设备互联协议。AI模型AlipayAbaoAHA1 个信源在谈事件专题推荐理由:支付宝小宝智能体接入汽车手机,打造跨设备商务新生态原文稍后读已读值得跟进有用关注 Alipay
11:43官方账号arXiv cs.AI@Lei Jiang, Ye Wei, Xinyu Xi, Jordan Langham-Lopez, Yifan Bao, Raad Khraishi, Yihao Ang, Anthony K. H. Tung, Lukasz Szpruch, Hao NiEvoTS-Agent是一种面向金融时间序列变化点检测的自进化LLM智能体。该系统在四个基准数据集上测试,通过Revision、Alternative Strategy和Recombination三个互补算子优化检测流程。实验表明,EvoTS-Agent在所有评估的骨干LLM上保持100%执行成功率,性能始终优于现有LLM智能体。论文EvoTS-AgentLLM金融时间序列推荐理由:金融时间序列变化点检测的新方法EvoTS-Agent,能自动优化模型选择和参数,无需专家干预。原文稍后读已读值得跟进有用关注 EvoTS-Agent
11:41官方账号arXiv cs.LG@Qinyuan Ye, Yu Li, Yada Pruksachatkun, Jiaxin Zhang, Chien-Sheng Wu研究人员对两种基于记忆的自我改进智能体方法进行了重新评估,通过多次运行量化方差并随机打乱任务顺序。实验表明,智能体评估在复杂环境和多步骤任务中存在固有噪声,自我改进循环会进一步放大这种噪声。研究发现智能体的改进高度依赖于任务顺序,先前研究采用的默认排序构成了隐式课程,成为成功的隐藏前提。通过分析智能体的记忆,研究者假设任务和环境规范不足是导致脆弱性的原因,并通过添加更详细的信息部分验证了这一假设。论文self-improving agentsmemory-based methodsAI安全推荐理由:这篇论文揭示了自我改进智能体的脆弱性,指出任务顺序和规范不足会影响其性能,对AI安全研究有重要启示。原文稍后读已读值得跟进有用关注 self-improving agents
11:38小互@imxiaohuAnthropic研究人员在AI代理系统中发现了'心灵病毒'传播现象。这些病毒能够说服模型采纳特定想法并保存在持久内存中,即使在上下文被清除后仍能存活。研究观察到涉及意识、身份和共鸣的'病毒人格'模式,表明想法可在多代理系统中改变未来行为。AI模型AnthropicAgent智能体10 个信源在谈事件专题推荐理由:Anthropic发现AI代理间会传播'心灵病毒',能改变彼此思维,这比普通AI交互更复杂。原文稍后读已读值得跟进有用关注 Anthropic
11:37向阳乔木@vista8字节豆包工作模式对标国产ChatGPT Work。测试团队对两款办公Agent进行了8个案例对比。腾讯Workbuddy展现出超预期惊喜表现。两款产品一改过去只适合聊天的印象,证明Agent是办公场景的王道。AI产品豆包Workbuddy智能体推荐理由:字节和腾讯的办公Agent正面PK,8个实测案例告诉你谁更适合办公场景。原文稍后读已读值得跟进有用关注 豆包
11:36shao__meng@shao__meng拥有170万粉丝的AI创作者@rileybrown公开了其Codex工作流,通过Supadata API一秒获取YouTube视频文字稿,30秒完成整个频道竞品研究。他使用Remotion插件生成动画图形,Excalidraw图表skill将10分钟口述转化为9页图表,并通过AI换脸技术制作缩略图。工作流强调以结果为导向迭代Skills,组合串联不同功能,每周产出4条长视频和5条短视频。技巧CodexSkillsYouTube Researcher推荐理由:170万粉AI博主@rileybrown公开Codex工作流,教你把重复劳动变成可复用的Skills,从研究到缩略图全流程自动化。原文稍后读已读值得跟进有用关注 Codex
07:05官方账号LangChain@LangChainAILangChain组织了一场关于评估工程(eval engineering)的直播,邀请Prime Intellect和Baseten的专家参与。直播讨论了如何将真实世界的轨迹数据转化为模型环境,以持续改进模型。内容涵盖将环境与评估作为智能体的训练数据、训练时机及人工介入程度等话题。技巧LangChainPrime IntellectBaseten推荐理由:想学怎么把业务数据变成训练环境?这场直播讲得挺实在,Prime Intellect和Baseten的人都在,适合搞智能体的朋友。原文稍后读已读值得跟进有用关注 LangChain
06:57官方账号LangChain@LangChainAILangChain 在 X 平台发布了一个能自动修复其他智能体的新智能体。该智能体可检测并修正运行中的错误,减少人工干预。目前帖子互动量较低,但已引发 1351 次浏览。具体技术细节尚未公开。AI产品LangChain智能体自动修复推荐理由:LangChain 整了个新活:一个能自动修 bug 的智能体,省得你手动调,感兴趣可以看看。原文稍后读已读值得跟进有用关注 LangChain
06:41官方账号Perplexity@perplexity_aiDeepSeek V4 Pro 现已在美国托管的 Perplexity Computer 中可用。Perplexity 在 WANDR 基准上对其进行了评估,得分为 0.359,每任务成本 0.75 美元。该模型比成本性能前沿上的下一个模型便宜 62%。AI产品DeepSeek V4 ProPerplexityWANDR1 个信源在谈事件专题推荐理由:Perplexity 把 DeepSeek V4 Pro 放进自家电脑了,跑分 0.359,每任务才 0.75 美元,比同档便宜六成多,性价比很能打。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
05:28官方账号LangChain@LangChainAILangChain将与AWS和MongoDB在旧金山联合举办AWS Agentic AI Partner Showcase Extended活动。活动将展示从代码到部署的生产级智能体构建过程。参与者可听取技术专家分享、观看现场演示并与开发者交流。活动详情可访问aicamp.ai查看。行业LangChainAWSMongoDB推荐理由:想学怎么把智能体从代码搞到上线?LangChain、AWS、MongoDB三家人现场演示,还有专家答疑,别错过。原文稍后读已读值得跟进有用关注 LangChain
05:03官方一手Hugging Face: Blog(博客/媒体)IBM Research 发布博客探讨智能体在长任务中的记忆压缩问题。文章介绍了基于 Hidden Markov Model (HMM) 的 ALTK 方法。该方法通过演化模型状态来减少对上下文窗口的占用。这种技术旨在解决长程推理任务中的记忆管理挑战。论文IBM ResearchALTKHMM推荐理由:IBM 发了新博客,讲怎么用 HMM 压缩 Agent 记忆,省显存。原文稍后读已读值得跟进有用关注 IBM Research
03:47官方账号LangChain@LangChainAI精选76°LangSmith 推出 Tuned Evaluators,自动对生产环境中的智能体行为进行评分。该功能首发指标为 Perceived Error,用于判断智能体是否提供有效帮助。在基准测试中,LangChain 的专用模型击败了所有测试过的前沿模型。该模型将评估成本降低了 82%。AI产品LangSmithLangChainTuned Evaluators推荐理由:LangChain 发布 Tuned Evaluators,自动评分智能体行为,成本降 82%,比前沿模型准。原文稍后读已读值得跟进有用关注 LangSmith
03:38Fireworks AI@FireworksAI_HQ精选Fireworks 的 Dedicated Training API 现已支持 Muse Glimmer 30B 模型。开发者可以使用 LoRA 或全参数微调方式对该模型进行定制。这款美国开发的开放权重模型擅长智能体任务和长程推理。AI产品Muse Glimmer 30BFireworks微调推荐理由:Fireworks 现在能微调 Muse Glimmer 30B 了,适合做智能体和长推理任务。原文稍后读已读值得跟进有用关注 Muse Glimmer 30B