8月11日
17:32
17:32官方一手歸藏(guizang.ai)@op7418
精选
DeepSeek 注册了名为 Deepseek Harness 的团队公众号,外界猜测其 Agent 产品可能即将发布。该公众号名称中的 Harness 或暗示与智能体开发框架相关。目前官方尚未公布具体产品细节,但此举被视为 DeepSeek 在 Agent 领域布局的信号。

推荐理由:DeepSeek 可能要发 Agent 了,刚注册了 Harness 团队公众号,想抢先看消息的可以关注下。
15:55
15:55Hunyuan@TXhunyuan
精选
腾讯混元推出Hy3D WorldClaw,这是一个智能体工作流,能从文本提示生成大规模3D开放世界。生成的场景不是视频或高斯泼溅,而是完全可自由探索的,由可编辑、游戏就绪的3D资产构成,具备高质量几何和纹理。项目页面已上线,展示了该工作流的能力。
推荐理由:腾讯混元这个新工作流能用文字直接生成能走进去的3D世界,不是视频,全是可编辑的游戏资产,做游戏或虚拟场景的可以看看。
12:35
12:35官方账号arXiv cs.LG@Mind Lab, :, Vin Bo, Asher Cai, Jingwei Cao, Song Cao, Vic Cao, Amelia Chen, Andrew Chen, Kaijie Chen, Cleon Cheng, Steven Chiang, Kaixuan Fan, Hera Feng, Huan Feng, Arthur Fu, Jun Gao, Pyke Han, Nolan Ho, Ori Hong, Hailee Hou, Piers Hua, Charles Huang, Miles Jiang, Nora Jiang, Yuyi Jiang, Qiuyu Jin, Fancy Kong, Kuss Koo, Jaron Lee, Andrew Lei, Alexy Li, Dawn Li, Lucian Li, Ray Li, Ricardo Li, Smith Li, Theo Li, Allen Lin, Elliot Lin, Fan Lin, Chen Ling, Kairus Liu, Kieran Liu, Logan Liu, Neo Liu, Xiang Liu, Yuxin Lu, Maeve Luo, Pony Ma, Verity Niu, Cole Qiao, Guian Qiu, Vince Qu, Sentry, Niko Song, Vincent Wang, Bo Wu, Rio Yang, Evelyn Ye, Fiona Ye, Ina Ye, Regis Ye, Josh Ying, Atlas Zeng, Danney Zeng, Salmon Zhan, Anya Zhang, Di Zhang, Mia Zhang, Sueky Zhang, Wei Zhao, Ada Zhou, Adrian Zhou, Yuhua Zhou, Juno Zhu, Murphy Zhuang
Macaron-V1是面向体验智能的开源智能体-模型家族,支持部署后持续学习。旗舰版Macaron-V1-Venti基于744B的GLM-5.2底座,搭配聊天、智能体、编程和GenUI四个LoRA适配器。Macaron-V1-Tall基于Qwen3.6(50B)设计,用于本地部署。系统采用模型-框架协同设计和递归自我改进循环,包含UI4A组件原生GenUI框架和智能体RL框架MindForge。在Personal Intelligence、GenUI和通用能力基准上进行了评估。
推荐理由:想了解怎么让模型部署后还能继续学?Macaron-V1用LoRA组合和递归改进做到了,744B大模型加四个专家LoRA,还开源。
11:48
11:48官方账号arXiv cs.AI@Wanying Qu, Qinghua Mao, Yu Li, Jiyao Liu, Xin Zhang, Dadi Guo, Yanxu Zhu, Qingyu Liu, Leitao Yuan, Xi Lin, Shanfeng Zhu, Yanwei Fu, Jing Shao, Xia Hu, Dongrui Liu
SHE框架将智能体安全机制分解为系统提示、规则库、安全记忆和工具策略四个组件,每个组件有明确的安全职责。该框架通过归因引导的进化循环,将轨迹失败转化为结构化诊断,并学习组件特定的边界优化。在Agent-SafetyBench上,SHE相比静态SafeHarness将攻击成功率降低3.1倍,同时提升良性效用。进化后的安全机制在AgentHarm基准上泛化到未见风险,并无需额外进化即可跨智能体模型迁移。
推荐理由:SHE把智能体安全从模型权重扩展到运行框架,分解成四个可独立进化的组件,实测攻击成功率降3.1倍,还能跨模型迁移,搞AI安全的值得看看。
11:46
11:46官方账号arXiv cs.AI@Abraham Gonzalez, Raghav Gupta, Akanksha Jain, Hanna Alam, Alexander Novikov, Po-Sen Huang, Matej Balog, Marvin Eisenberger, Sergey Shirobokov, Ngân Vũ, Hank Levy, Borivoje Nikolić, Sagar Karandikar, Martin Dixon, Parthasarathy Ranganathan
ArchAgent v2 将自动化微架构搜索扩展到多级数据预取。它引入级联进化搜索,按缓存层级依次进化和冻结预取器,并加入硬件可实现性反馈回路,在进化过程中实时估算硬件规模。在 DPC4 规则下,ArchAgent v2 自动设计的三级预取器比人工设计的冠军方案表现更好,几何平均 IPC 较基线提升 3.8%,较前冠军 BertiGO 提升 0.3%。在低带宽单核配置下,其性能提升达 4.6%,而 BertiGO 仅为 2.6%。
推荐理由:AI 自动设计芯片预取器,居然跑赢了 DPC4 冠军方案,单核低带宽下提速 4.6%,搞硬件架构的值得看看。
10:30
10:30向阳乔木@vista8
DeepSeek Harness 团队已在微信公众号开设账号,目前尚未发布任何内容。该团队后续将展示其 Harness 框架的实际表现,并与 Pi Agent 等同类框架进行对比。外界关注点还包括 IDE 版本能否推出,以及产品设计能否超越 Codex。

推荐理由:DeepSeek Harness 团队开公众号了,还没动静。想看看他们之后会不会跟 Pi Agent 硬刚,甚至出 IDE 版。
10:23
10:23官方一手Pandaily@contact@pandaily.com (Pandaily)
腾讯Lighthouse Cloud托管的AI技能社区SkillHub,现已收录超过10万个技能,月下载量超过1000万次。该社区与OpenClaw对齐,并借助TRACE评估框架筛选技能质量。TRACE的评估结果显示,约20%的技能真正有效。平台通过这一框架将可用技能从前十多万个选项中凸显出来。
事件专题

推荐理由:腾讯的SkillHub技能破10万、月下载千万,但只有两成能用。TRACE这个评估层就是帮你从海量技能里捞出真正好用的。
06:34
06:34Google AI Developers@googleaidevs
Google AI开发者团队在真实赛道测试了边缘架构,证明智能体工作流能在要求稳定性能的环境中正常运行。团队在开发者博客发布了更多细节,指导开发者从零开始构建类似方案。
推荐理由:Google AI官方在赛道上实测了边缘架构,证明智能体跑关键任务不掉链子,还有博客能照着搭。
06:33
06:33Google AI Developers@googleaidevs
Google工程师用Antigravity在赛道上进行代码的实时迭代,并搭建实时遥测管道。Agent Development Kit(ADK)负责管理多智能体任务。Gemma 4模型在Pixel 10的TPU上本地运行,提供零延迟的音频教练提醒。这套方案支持离线推理,无需联网即可工作。
事件专题

推荐理由:Google这波玩法挺新鲜:Antigravity写代码、ADK管多智能体,Gemma 4直接离线跑在Pixel 10上做实时语音教练,响应很快。
04:29
03:58
02:43
02:43官方一手Cloudflare Blog@Kathy Liao
2026年8月,Cloudflare 的 Agents Week 落幕。官方回顾博客汇总了期间所有公告,标题为 Everything we launched during Agents Week。发布内容从 Wallets 到 Radar,覆盖多个产品。原文 URL 为 blog.cloudflare.com/agents-week-review-august-2026。

推荐理由:Cloudflare 把 Agents Week 的所有公告都整理到一篇博客里了,从 Wallets 到 Radar,直接看这篇就能知道他们发了啥。