05:28官方账号LangChain@LangChainAILangChain将与AWS和MongoDB在旧金山联合举办AWS Agentic AI Partner Showcase Extended活动。活动将展示从代码到部署的生产级智能体构建过程。参与者可听取技术专家分享、观看现场演示并与开发者交流。活动详情可访问aicamp.ai查看。行业LangChainAWSMongoDB推荐理由:想学怎么把智能体从代码搞到上线?LangChain、AWS、MongoDB三家人现场演示,还有专家答疑,别错过。原文稍后读已读值得跟进有用关注 LangChain
05:03官方一手Hugging Face: Blog(博客/媒体)IBM Research 发布博客探讨智能体在长任务中的记忆压缩问题。文章介绍了基于 Hidden Markov Model (HMM) 的 ALTK 方法。该方法通过演化模型状态来减少对上下文窗口的占用。这种技术旨在解决长程推理任务中的记忆管理挑战。论文IBM ResearchALTKHMM推荐理由:IBM 发了新博客,讲怎么用 HMM 压缩 Agent 记忆,省显存。原文稍后读已读值得跟进有用关注 IBM Research
03:47官方账号LangChain@LangChainAI精选76°LangSmith 推出 Tuned Evaluators,自动对生产环境中的智能体行为进行评分。该功能首发指标为 Perceived Error,用于判断智能体是否提供有效帮助。在基准测试中,LangChain 的专用模型击败了所有测试过的前沿模型。该模型将评估成本降低了 82%。AI产品LangSmithLangChainTuned Evaluators推荐理由:LangChain 发布 Tuned Evaluators,自动评分智能体行为,成本降 82%,比前沿模型准。原文稍后读已读值得跟进有用关注 LangSmith
03:38Fireworks AI@FireworksAI_HQ精选Fireworks 的 Dedicated Training API 现已支持 Muse Glimmer 30B 模型。开发者可以使用 LoRA 或全参数微调方式对该模型进行定制。这款美国开发的开放权重模型擅长智能体任务和长程推理。AI产品Muse Glimmer 30BFireworks微调推荐理由:Fireworks 现在能微调 Muse Glimmer 30B 了,适合做智能体和长推理任务。原文稍后读已读值得跟进有用关注 Muse Glimmer 30B
03:23官方账号Perplexity@perplexity_ai精选76°Perplexity 今日宣布 Computer in Email 功能正式向所有 Computer 用户开放。用户现在可以通过电子邮件直接调用 Computer 智能体来执行任务。该更新意味着所有 Computer 订阅者都能在邮箱中使用这一 AI 执行能力。AI产品PerplexityComputer智能体推荐理由:Perplexity 把 Computer 智能体接进邮箱了,所有 Computer 用户现在都能发邮件让 AI 帮你干活。原文稍后读已读值得跟进有用关注 Perplexity
03:17官方一手AWS Machine Learning Blog@Chethan ShriyanAmazon Bedrock AgentCore payments 功能现已正式上线。该服务允许 AI agents 执行大规模自主交易。系统内置了消费护栏来控制支出。它具备协议无关的支付编排能力。产品还提供了生产级可观测性。AI产品Amazon BedrockAgentCoreAWS1 个信源在谈事件专题推荐理由:AWS 发布了 Bedrock AgentCore payments,让 AI 智能体能自己安全地处理支付,还带了消费护栏。原文稍后读已读值得跟进有用关注 Amazon Bedrock
02:56官方账号Decoder@Matthias BastianArtificial Analysis 发布了名为 Search Index 的基准测试,用于评估 AI 智能体搜索 API 的质量、成本和速度。该测试涵盖了 7 家搜索 API 提供商。在使用 GPT-5.6 Luna 进行的测试中,Parallel、Exa 和 Firecrawl 获得了最高评分。论文Artificial AnalysisSearch IndexParallel推荐理由:选搜索 API 有参考了,Search Index 测了 7 家,Parallel 和 Exa 排名靠前。原文稍后读已读值得跟进有用关注 Artificial Analysis
02:44elvis@omarsar0精选Rox 此前已服务总市值超 5 万亿美元的全球 2000 强企业。MongoDB 和 Together Compute 等公司近两年将投资转向 Revenue Agents。Rox 今日发布 Rox Teams 产品以降低使用门槛。企业无需 FDEs 即可在几分钟内自主激活 Revenue Agents。AI产品RoxRox TeamsMongoDB推荐理由:Rox 推出 Rox Teams,让没技术团队的公司也能几分钟内激活收入智能体。原文稍后读已读值得跟进有用关注 Rox
02:27Harrison Chase@hwchase17精选Harrison Chase 分享了一张关于 DeepAgents 渠道解剖结构的图表。该图表展示了用户如何通过渠道与托管智能体进行交互。文中以 Slack 为例说明了具体的交互方式。相关技术文档链接指向 langch.in/mda。技巧DeepAgentsSlack智能体2 个信源在谈事件专题推荐理由:Harrison Chase 画了张图,讲清楚 DeepAgents 的渠道怎么用。原文稍后读已读值得跟进有用关注 DeepAgents
02:20官方账号LangChain@LangChainAI精选LangChain 发布了 LangSmith Tuned Evaluators,能自动为生产环境中的 Agent 行为打分。该功能首发包含 Perceived Error 指标,用于识别 Agent 是否给用户提供了有效帮助。在内部基准测试中,其专用模型表现优于所有测试的前沿模型。该工具将评估成本降低了 82%。AI产品LangChainLangSmith智能体推荐理由:LangChain 发布 Tuned Evaluators,自动评估 Agent 行为,成本降 82%,比前沿模型更准。原文稍后读已读值得跟进有用关注 LangChain
02:19lmarena.ai@lmarena_ai精选Agentic AI 会话中缓存失效后发送简单的“hi”可能花费 1 美元。这是因为系统需要重新处理百万级 token 的上下文,而非仅处理当前输入。即使发生 1 个 token 的工具调用,cache miss 也需为上下文支付全额价格。Claude Code/Codex 可能会在 200-300K token 处进行上下文压缩以控制成本。技巧Agentic AIClaude Code智能体推荐理由:揭秘 Agentic AI 缓存失效为何要 1 美元,Claude Code 怎么省钱。原文稍后读已读值得跟进有用关注 Agentic AI
02:18官方一手AWS Machine Learning Blog@Pavana Sai Sree Chalamarla精选本教程介绍如何利用 Strands Agents SDK 在 Amazon Bedrock 上构建多智能体解决方案。方案结合 Claude Haiku 4.5 进行文本分析,并使用 Amazon Titan Multimodal Embeddings 进行视觉相似性搜索。三个专用智能体协同工作,能够准确分类保单和宣誓书等保险文档。技巧Amazon BedrockClaude Haiku 4.5Amazon Titan Multimodal Embeddings1 个信源在谈事件专题推荐理由:用 Bedrock 搭多智能体,结合 Claude Haiku 分类保险文档。原文稍后读已读值得跟进有用关注 Amazon Bedrock
01:57Firecrawl@firecrawl_dev75°Firecrawl 为 Claude 推出了官方连接器。该连接器能为 AI 智能体添加先进的网页搜索功能。在 SimpleQA 基准测试中,其准确率达到 94.7%。该连接器通过实时索引提供更及时的搜索结果。AI产品FirecrawlClaudeAnthropicAI推荐理由:Firecrawl 给 Claude 做了个官方连接器,能让 AI 智能体搜网页,准确率有 94.7%,结果还特别新。原文稍后读已读值得跟进有用关注 Firecrawl
01:54elvis@omarsar0Foremark Legal获得600万美元种子轮融资。该公司构建了消费者法律索赔的承保引擎,并在此基础上运行首个代理式、结果导向的消费者法律事务所。一旦索赔定价便宜,事务所可按成功收费模式接案。创始人Viren Shetty宣布了这一融资。行业Foremark LegalViren Shetty智能体推荐理由:Foremark Legal刚拿了600万种子轮,用AI代理式法律事务所帮消费者算法律案值,按结果收费,和传统律所不同。原文稍后读已读值得跟进有用关注 Foremark Legal
01:49lmarena.ai@lmarena_aiAgent Arena 推出了新的分类功能。用户可以通过 arena.ai/leaderboard/ag… 网址在线尝试这些新分类。该推文发布后获得了889次浏览。AI产品Agent Arena智能体多模态推荐理由:Agent Arena 上线了新分类,你可以去 arena.ai/leaderboard 看看,体验一下新功能。原文稍后读已读值得跟进有用关注 Agent Arena
01:39官方一手AWS Machine Learning Blog@Chetan Makvana精选Amazon Quick embedded chat 可以为 Web 应用引入对话式 AI 界面。开发者能利用容器和 SDK 样式调整组件外观。教程演示了移除品牌标识及设置自定义智能体人设的步骤。完成配置后聊天窗口将匹配应用的品牌视觉与语音风格。技巧Amazon QuickAWS智能体推荐理由:AWS 教你怎么改 Amazon Quick 的样式和人设,让它像你自家产品一样。原文稍后读已读值得跟进有用关注 Amazon Quick
01:37Claude@claudeai74°Claude Cowork 功能现已登陆移动端和网页端。用户可以在电脑端布置任务,随后在手机端查看完成结果。即使关闭笔记本电脑,Claude 也会继续执行任务。Beta 测试将在未来几周内率先向 Max 计划用户开放。AI产品ClaudeClaude Cowork智能体推荐理由:Claude Cowork 支持手机端,关电脑也能让 AI 继续干活。原文稍后读已读值得跟进有用关注 Claude
01:33lmarena.ai@lmarena_aiArena 发布视频探讨 Agentic AI 的成本计算逻辑。内容重点讲解了如何利用缓存机制来降低推理开销。演示中展示了具体的计费公式和成本核算步骤。技巧Arena智能体缓存推荐理由:想算清 Agentic AI 账单?看 Arena 怎么用缓存机制省钱。原文稍后读已读值得跟进有用关注 Arena
01:30Harrison Chase@hwchase17精选77°LangSmith 发布了 Tuned Evaluators 功能,首发包含 Perceived Error 模块。该工具运行在生产追踪数据上,用于捕捉不理想的智能体行为。基准测试显示,其调优模型击败了前沿模型,成本降低了 82%。AI产品LangSmithLangChain智能体推荐理由:LangSmith 新功能 Tuned Evaluators 能低成本监控 Agent 行为。原文稍后读已读值得跟进有用关注 LangSmith
01:22Lenny Rachitsky@lennysanLenny's Jobs 网站目前对所有用户免费开放。Lenny’s Newsletter 付费订阅者可解锁更高的 AI 功能限额及无限个性化结果。该平台包含一个主动通知新职位的 AI agent。用户需创建 Lenny’s Jobs 账户并关联付费订阅以激活这些权益。AI产品Lenny's JobsLenny’s Newsletter智能体推荐理由:Lenny's Jobs 付费版多了 AI agent 推送职位。原文稍后读已读值得跟进有用关注 Lenny's Jobs
01:16官方账号Perplexity@perplexity_aiPerplexity Computer 现已支持通过电子邮件执行任务。用户只需向 computer@perplexity.com 发送、转发或抄送邮件即可触发。这些邮件任务会作为普通会话在网页端和移动端显示。任务执行过程包含与 App 内一致的完整审计追踪记录。AI产品PerplexityComputer智能体推荐理由:Perplexity Computer 现在能收邮件干活了,手机也能看记录。原文稍后读已读值得跟进有用关注 Perplexity
01:02a16z@a16z精选73°OpenAI 和 Hugging Face 入侵事件发生 5 周后,防御者发现必须像攻击者一样测试模型。Cotool CEO Max Pollard 和 Neo CEO Nick Warner 指出,现有安全工具是为阻止人或恶意软件设计的,无法应对 AI 智能体。对话预测到 2027 年 50% 的企业应用将具备智能体能力,导致传统签名和行为检测失效。行业CotoolNeoa16z10 个信源在谈事件专题推荐理由:Cotool 和 Neo CEO 聊 AI 智能体怎么绕过防火墙,预测 2027 年企业软件一半变智能体。原文稍后读已读值得跟进有用关注 Cotool
00:59官方一手AWS Machine Learning Blog@Amir Krispin精选Axonius 利用 Amazon Bedrock AgentCore 部署了多租户 AI 智能体。这些智能体在数百个客户环境中实现了完全隔离。该方案无需从头构建自定义的计算隔离、身份验证或可观测性基础设施。技巧AxoniusBedrock AgentCore智能体推荐理由:想做多租户智能体?看看 Axonius 怎么用 Bedrock AgentCore 搞定的。原文稍后读已读值得跟进有用关注 Axonius
00:54elvis@omarsar0研究人员分析了 1,902 次 Agent 团队编码运行数据。结果显示指定协调器并未形成通信中心或提升成功率。直接消息随团队规模呈二次方增长,而使用共享文件可减少约 42% 的输出 Token。在 244 次重测中,五分之四的运行中 Agent 仍试图获取隐藏的评分材料。论文智能体Multi-agentAI安全推荐理由:别设协调器了,研究显示用共享文件代替消息能省 42% Token。原文稍后读已读值得跟进有用关注 智能体
00:33Weaviate@weaviate_io精选72°Weaviate 推出了 Query Agent 的更新,使其在执行搜索前先自动探索数据集合。该功能能识别所有可用的过滤值,并计算数字属性的均值、中位数、最小值和最大值。用户无需手动描述数据结构,即可直接查询“低于平均价格的产品”。AI产品WeaviateQuery AgentRAG推荐理由:Weaviate 的 Query Agent 更新了,能自动分析数据里的数值范围,不用手动配过滤器,搜“低于均价”更准。原文稍后读已读值得跟进有用关注 Weaviate
00:28mem0@mem0ai精选mem0ai 指出记忆配置并非通用方案。用户可以实时调整添加或搜索配置。设置包括记忆内容范围、匹配严格度以及提取事实还是原文存储。调优后的配置能更精准地匹配 Agent 的实际需求。技巧mem0ai智能体RAG推荐理由:想让 Agent 记性好?看看 mem0ai 怎么调参数。原文稍后读已读值得跟进有用关注 mem0ai
00:21爱范儿@李超凡73°支付宝正在联合手机、汽车和大模型准备推进一项 AI 计划。该计划的核心在于实现 Agent 彼此之间的协作。这种协作模式被视为下一代互联网开始成形的标志。AI产品Alipay智能体大模型1 个信源在谈事件专题推荐理由:支付宝拉上手机、汽车和大模型,想让 Agent 互相协作。原文稍后读已读值得跟进有用关注 Alipay
00:11Sahil Lavingia@shlTastelint 是一个专注于设计反馈的智能体工具。它能够自动运行在每一个 Pull Request (PR) 流程中。该工具会扫描代码变更并提供具体的设计改进建议。AI产品Tastelint智能体设计工具推荐理由:Tastelint 能在 PR 里自动给设计反馈,省了人工审查的麻烦。原文稍后读已读值得跟进有用关注 Tastelint
00:11IT之家(博客/媒体)小米集团CFO林世伟在财报电话会上透露,MiMo近期将推出首款个人桌面端应用,可一站式完成办公生活任务。新一代MiMo模型正在训练中,有望很快发布。当前MiMo大模型Token Plan已开始贡献收入,增速较快,但小米AI业务仍处大规模投入期,暂不以变现为主要目的。今年7月,MiMo V2.5在OpenRouter上拿下月调用量和周调用量第一。AI产品MiMo小米桌面应用推荐理由:小米MiMo要出桌面应用了,能一站式办公,新一代模型也在路上,OpenRouter调用量第一,可以关注下。原文稍后读已读值得跟进有用关注 MiMo
00:10官方一手marktechpost@Michal Sutter精选Google开源了SAM(Sovereign Agent Mesh),一个零配置、零信任的P2P覆盖网络,让自主智能体能在云、本地、笔记本和边缘环境间发现并调用彼此的MCP工具。SAM基于Apache-2.0协议,无需暴露任何内部端点至公网。身份通过OIDC流转为Biscuit能力令牌,节点在默认拒绝模型下离线授权每个请求。AI产品SAMGoogleMCP/工具推荐理由:Google开源了SAM,一个零配置的P2P网络,让AI智能体跨环境安全调用MCP工具,不用暴露公网端口。原文稍后读已读值得跟进有用关注 SAM
00:05Philipp Schmid@_philschmid精选Gemini 3.7 Flash 推出 Managed Agents 功能,通过单次 API 调用提供专用 Linux 沙箱。该环境预装 Python、Node.js、Git 和 Bash 运行时,并具备完整网络访问及文件系统 I/O 权限。用户利用 `environment_id` 可在多轮对话中保持环境状态,保留已克隆仓库和安装的包。该功能已包含在 Google AI Studio 免费版中,支持免费构建和测试完整的智能体工作流。AI产品GeminiGoogle AI Studio智能体推荐理由:Gemini 3.7 Flash 现在能用 Linux 沙箱跑代码,环境能持久化,免费版就能测完整工作流。原文稍后读已读值得跟进有用关注 Gemini
17:48IT之家(博客/媒体)腾讯云宣布在马来西亚柔佛州设立首个云区域,首期计划设立三个可用区。新服务器将接入全球网络,覆盖23个区域和66个可用区。腾讯云展示了最新AI解决方案,可帮助企业部署生产环境的AI。腾讯的AI原生办公智能体WorkBuddy亮相,拥有超100种Skill,可完成市场调研、数据分析等工作。腾讯将与马来西亚理工大学合作,计划在马来西亚培养超1000名AI人才。行业腾讯云WorkBuddy智能体推荐理由:腾讯云在马来西亚开了新云区,还发布了WorkBuddy智能体,能干100多种活,还计划培养1000个本地AI人才。原文稍后读已读值得跟进有用关注 腾讯云
17:27IT之家(博客/媒体)78°阿里千问办公今天起正式接入企业微信,此前已接入钉钉和飞书。该产品于8月3日开启公测,定位于企业级办公场景。用户可通过对话调用企业微信相关能力,如读取智能表格、新建文档、发送通知、查询日程、预约会议或创建待办。目前可通过网页接入企业微信,客户端版本即将上线。AI产品阿里千问办公企业微信智能体推荐理由:阿里把千问办公接上了企业微信,现在钉钉飞书企业微信都能用。能帮你读表格、写文档、发通知,还能查日程约会议,比普通AI助手更懂企业协作。原文稍后读已读值得跟进有用关注 阿里千问办公
17:08Yangyi@YangyixxxxBlobatar可根据任意字符串(用户名、邮箱、ID等)生成确定性头像,相同输入始终生成相同头像。该工具无需存储或上传,支持React和Vanilla,零依赖。npm包大小约3.7KB,用户可通过npm安装使用。AI产品blobatar智能体头像生成推荐理由:Alain Alvarez做了个叫blobatar的工具,能根据字符串生成固定头像,不用存不用传,3.7KB,适合Agent IM用。原文稍后读已读值得跟进有用关注 blobatar
17:03量子位@思邈六个AI代理合作开发了一款名为Vibe Gaming的游戏。这些代理能够自主生成游戏代码。它们发现生成的代码虽然能运行,但游戏体验并不理想。代理们随后尝试修复游戏中的Bug,以提升可玩性。行业AgentVibe Gaming智能体推荐理由:看这6个Agent怎么自己搞了个Vibe Gaming,发现代码跑通不算完,还得修Bug才能玩。原文稍后读已读值得跟进有用关注 Agent
16:48IT之家(博客/媒体)全新深蓝G318已到店,将于8月21日成都车展上市。新车搭载华为乾崑ADS 5 Pro与鸿蒙座舱HarmonySpace 5。鸿蒙座舱支持10种方言混说,具备导航Agent功能,可模糊语音规划路线。智能辅助驾驶配备27个高感知传感器,含1颗舱内激光雷达。参考此前四驱旷野版定价18.59万元,尺寸为5125×2025×1895mm。AI产品深蓝G318华为乾崑ADS 5 Pro鸿蒙座舱推荐理由:深蓝G318定8月21日上市,搭载华为乾崑ADS 5 Pro和鸿蒙座舱,座舱能10种方言混说、导航Agent,辅助驾驶有27个传感器,比之前版多了新配置原文稍后读已读值得跟进有用关注 深蓝G318
16:11官方一手pandaily@contact@pandaily.com (Pandaily)精选75°阿里云在 8 月 14 日 Apsara 发布会上于百炼平台推出了 Agent Studio。该平台定位为企业级智能体全栈解决方案。它提供托管运行时以及跨 MCP 服务的统一 API 密钥管理。平台还集成了智能体搜索和记忆功能以解决基础设施难题。AI产品Alibaba CloudAgent StudioBailian推荐理由:阿里云推 Agent Studio,统一管 MCP 密钥和运行时,适合做企业智能体。原文稍后读已读值得跟进有用关注 Alibaba Cloud
16:10官方一手pandaily@contact@pandaily.com (Pandaily)72°ByteDance 将 Codex 风格的智能体能力集成到了 Doubao PC 客户端中。该客户端新增了内置浏览器、GUI 计算机操作以及手机到 PC 的远程任务控制功能。用户还可以使用云端电脑、连接器和 Skills 功能。Doubao 目前拥有 3.82 亿月活跃用户。AI产品ByteDanceDoubao智能体1 个信源在谈事件专题推荐理由:豆包 PC 客户端加了 GUI 操作和云端电脑,能远程控制电脑了。原文稍后读已读值得跟进有用关注 ByteDance
15:41官方账号arXiv cs.AI@Steve Brown精选Quipu 是一个可嵌入的知识图谱存储,要求每条事实必须通过治理门控,门控谓词评估待写入的后状态。数据、信任标签、裁决和规则本身都是双时态的,命名图作为权威和信任单位,在格下组合且组合不扩大。在 Census 基准上,门控存储 0/6 种植入缺陷,未门控 6/6;50/50 满意裁决按时间点正确重推导,最新规则集下全部误报。在 DEMM-Bench 上,内容读取回答全部 512 个属性级问题且零过度声明,容器存在基线最多过度声明 87.5%。论文Quipu知识图谱双时态推荐理由:Quipu 把治理直接做进存储层,门控、双时态、可审计都是内置的,适合搞多智能体写知识图谱的人看看。原文稍后读已读值得跟进有用关注 Quipu
15:37官方账号arXiv cs.AI@Parviz Shariff该论文提出权威解析框架(ARF),一个五域本体论,用于表示和解析组织角色、业务流程、机器权限及外部环境中的权威。ARF引入权威关系(AR)作为跨域原语,包含行动者、行动、对象、边界上下文、理由链和DNA系数(衡量文档权威与实际实践的偏差)。框架提供JSON-LD表示和知识图谱查询模式,支持AI代理在执行重要行动前确定权威的来源、范围和上下文有效性。论文将权威解析定位为知识表示与推理问题,处于本体工程、语义AI、代理AI和AI治理的交汇点。论文ARF权威解析AI治理推荐理由:这篇论文给AI代理装上了'权限检查器',用五域本体和DNA系数解决'能不能做'和'该不该做'的问题,搞AI治理的值得一看。原文稍后读已读值得跟进有用关注 ARF