8月14日
19:42
18:14
18:14AI Will@FinanceYF5
据TickerTrends追踪,OpenClaw在企业账户绝对数量上仍保持领先。但最近4周Hermes Agent的采用速度明显更快,增长动能更强。追踪数据显示两者在增长速度上的差距正在缩小。
事件专题

推荐理由:TickerTrends的最新数据说OpenClaw企业账户还领先,但Hermes Agent最近4周涨得更快,两者差距在缩小,看看你押哪个。
17:26
17:26官方一手歸藏(guizang.ai)@op7418
72°
智谱发布GLM-5.3,基于743B基础模型仅做后训练,未重新预训练。新版本重点提升安全能力,针对模型防御场景做了优化。长程任务执行显著增强,包括终端操作、工具调用及大型代码库修复。在开源模型中,其网络安全能力达到新水平。
事件专题

推荐理由:智谱发了GLM-5.3,没重新预训练就靠后训练把安全和长程任务拔高一大截,搞智能体或代码修复的值得看看。
16:23
16:23官方一手Pandaily@contact@pandaily.com (Pandaily)
DAC 2026上,Synopsys发布L1-L5自主等级路线图。Cadence推出AuraStack超级智能体,Siemens EDA发布物理验证的Fuse智能体。Kimi K3用48小时自主完成芯片设计。中国厂商Xpeedic、XEPIC、UniVista正在跟进智能体EDA。
事件专题

推荐理由:三大EDA巨头在DAC 2026同时亮出智能体方案,Kimi K3已经连续干了48小时芯片设计,中国厂商也在抢这波机会。
16:19
16:19官方一手pandaily@contact@pandaily.com (Pandaily)
Shenhai Zhiren 完成5亿元人民币A轮融资,新投资方包括 GGV Capital 和 Cathay Capital 旗下基金。老股东 BYD、Lightspeed China 继续跟投。其 Phoenix 600 电缆埋设机器人可在3000米深海作业,已获阿联酋电信1亿元订单。公司还发布了水下智能体模型 SEAgent 1.0。

推荐理由:Shenhai Zhiren拿下5亿融资,Phoenix 600深海机器人获阿联酋1亿订单,还发布SEAgent水下智能体,挺猛。
15:14
15:14Geek@geekbb
Z.ai发布开源模型GLM-5.3,基于743B基础模型进行后训练。官方称其编码与智能体能力达到顶级水平,并在网络安全领域为开源模型树立新标准。社区讨论中,有网友希望其定价能压低Grok 4.6和DeepSeek V4 Pro。
事件专题

推荐理由:GLM-5.3开源发布了,743B后训练,主打编码和网络安全。蹲个价格,看它能不能背刺Grok和DeepSeek。
14:56
14:56ollama@ollama
Z.ai 发布开源模型 GLM-5.3,通过 743B 基础模型后训练实现顶级编码与智能体能力。该模型在网络安全领域设立新标准,成为开放模型的新标杆。Ollama 宣布将在其正式开放发布时提供支持,技术博客已公开细节。
事件专题

推荐理由:GLM-5.3 来了,743B 底座,编码和网络防御能力很强,Ollama 也已宣布支持,想试的可以直接上手。
12:22
12:22官方账号arXiv cs.AI@Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong Li
AutoDesign是面向长周期智能体设计的框架,能将多模态源转化为结构化媒体输出,聚焦论文到海报生成任务。该框架引入PosterBench基准,主轨含100篇论文,横跨五个学科,验证子集含10篇。在主轨上AutoDesign得分78.32,超过闭源系统Claude Design 7.45分。在七个受控配置中,加入DesignHarness将平均得分由54.99提至67.39,提升12.4%。完全自主循环中它执行253次工具调用和11轮编辑,40分钟内成本低于3美元。
事件专题

推荐理由:AutoDesign能自动把论文变海报,PosterBench上比Claude Design高7.45分,40分钟成本不到3美元。
11:49
11:43
11:43Aravind Srinivas@AravSrinivas
精选
Perplexity宣布将Sonar迁移至Agent API。该API在保持联网搜索的基础上,新增多步研究、代码执行、内建工具,并可通过单一接口访问多种模型。在BrowseComp和WideSearch基准上,Agent API的得分超过Sonar最佳成绩的两倍。
推荐理由:做联网搜索Agent?Perplexity Agent API支持多步研究、代码执行,基准分翻倍,值得一试。
11:29
11:29官方账号arXiv cs.LG@Zhe Ye, Hantao Lou, Yuechun Sun, Peiyang Song, Zhengxu Yan, Timothe Kasriel, Qingyang Zhang, Kaiyu Yang, Soonho Kong, Jingxuan He, Dawn Song
精选
Vero是首个评估仓库级联合实现与证明合成的基准,包含43个多模块实例。实例来自Python、Dafny、Verus和Coq的真实仓库,覆盖密码协议到分布式系统等领域。每个实例基于Lean 4,支持仅证明和代码加证明两种评估模式。最强智能体配置仅完整解决27/43个实例,在最高难度仓库上未闭合任何规格。
推荐理由:Vero拿43个真实仓库考AI写代码加形式化证明,最强配置只过了27个,想看看代码生成靠谱程度的可以来测测。
10:54
10:23
10:23官方一手Pandaily@contact@pandaily.com (Pandaily)
DeepSeek Harness 于8月13日晚8:30发布开发者预览并开源,当前版本为v0.1。产品提供四种预设工作模式,采用一切皆插件的架构设计。官方将其核心思想概括为“模型+Harness=智能体”。这次开源被认为是今年最具雄心的智能体开源项目之一。

推荐理由:DeepSeek 把 Harness 开源了,四个工作模式直接搭智能体骨架,插件随便接,玩起来很有野心。
10:19
10:19官方一手pandaily@contact@pandaily.com (Pandaily)
8月13日,DeepSeek正式发布V4 Pro模型,并同步推出Harness开发者预览。Harness基于Cordis插件系统构建,将每个智能体能力封装为插件。该项目以MIT许可证开源,开发者可自由修改与商用。Harness提供append-only会话日志,可完整追踪智能体运行轨迹,便于调试与审计。

推荐理由:DeepSeek把Harness以MIT开源了,插件化架构,每个能力都是插件,还有完整轨迹日志,适合自己折腾智能体的朋友。
05:17
05:11
05:11官方账号Cursor@cursor_ai
精选72°
Cursor宣布Firetiger团队正式加入。双方将共同开发能跟随代码进入生产环境并自动修复故障的智能代理。这次整合让Cursor的AI代理能力从代码生成延伸到部署后运维。
事件专题

推荐理由:Cursor把Firetiger团队收了,他们要做能盯生产环境、出问题自己修的代理,和别家只写代码的不一样。