有人把 Github、Cloudflare 和豆包播客 API 交给几个 Bot,让它们自己讨论拍板,搭了个 24 小时 AI 新闻台,还打算开源,可以蹲一下代码。
#多智能体
共 233 条 · 7 天 13 条 · 30 天 57 条
信息流里打上「多智能体」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
开发者用多 agent 协作搭建 24 小时 AI 新闻播报电视台
10月8日
Stanford 论文 DeLM:去中心化多智能体在编程任务上跑赢 Claude Code
Stanford 把多智能体编程的中央调度改成了共享任务队列,在 Codex 和 Claude Code 上实测快 2.49 倍,还开源了插件,可以直接试。
10月7日
Google Research 将在 COLM 2026 展示多智能体视频生成框架 Co-Director
Google 搞了个多智能体框架 Co-Director,专门解决 AI 视频长篇叙事前后不一致的问题,COLM 2026 现场有交互演示,做视频生成的可以去围观。
10月6日
论文13:37
学习型角落选择启发式改进 CADENCE 算法效率CADENCE 算法部署守卫时不知道该把智能体放到哪个角落,这篇论文用 CNN 和 GATv2+DQN 学会挑角落,7500 次测试跑得更快、用的智能体更少,形式化保证还一点没丢。
研究:Qwen2.5-7B-Instruct 可被训练出仅在多智能体场景触发漏洞的拓扑后门
有人把 Qwen2.5-7B 微调成只在多智能体环境里写漏洞代码的模型,单智能体测试完全查不出来,安全团队该看看这篇。
用 Amazon Bedrock AgentCore 评估多智能体系统的可解释性与有用性
AWS 出的实操教程,教你怎么用 Bedrock AgentCore 评估多智能体系统,供应链场景例子很完整,做 Agent 工程的可以照着搭。
10月5日
10月3日
10月2日
10月1日
9月30日
9月29日
Perplexity 推出 Research Fellowship,聚焦持续学习与多智能体研究
Perplexity 在招研究员,方向是多智能体和合成数据,出钱还开放研究成果,9 月 30 日前可申请。
9月28日
微软研究院发布 Agensh:千级编码智能体无中心协同框架
微软研究院的 Agensh 论文,不用中央调度器,让 1000 多个编码智能体靠共享状态自己协作,pandoc 任务通过率从 33.89% 干到 55.06%,玩法挺新鲜。
AgentWorld 基准发布:测试多智能体长程协作能力
一个新的多智能体协作基准,用 MMORPG 沙盒逼模型跑 50 多轮团队任务,Gemini 3 Flash 也只拿到 52% 成功率,能看清现在模型协作到底差在哪。
9月25日
Odyssey 发布 Agora-2 研究预览版:实时生成支持 20 人在线的世界
Odyssey 把世界模型做成了能 20 人同时在线的实时游戏,画面全靠模型生成,别人一动你那边的世界也跟着变,可以去试试这个预览版。
Odyssey 发布 Agora-2:20 个人与智能体可实时共享同一模拟世界
Odyssey 出的 Agora-2 能让 20 个人和智能体进同一个实时模拟环境,可以拿来训练机器人或研究智能体合谋,预览版已经能玩。