Google 这个 Gemini Agent 给每个任务单独一台电脑,还能像员工一样挂邮箱进公司通讯录,模型还能在 Gemini 和 Claude 之间随便换,挺有意思。
#智能体
Amazon 给智能体加了按次付费能力,Incarna 的智能体能用 x402 一单一单付钱给 BlockRun,几周集成活缩到几天。
Google 的 Gemini Agent 要接入 Claude Opus 5 和 Sonnet 5.5 了,Claude 首次出现在 Gemini 上,企业用户一个平台能用两家模型。
OpenRouter 晒了客户 Ori 的成绩单:成交快了 34%,成交率涨 2.6 倍,还会自动换便宜模型省钱,Slack 智能体也快上线了。
Hugging Face 上线了个新玩法,丢一篇论文给智能体,它能自己跑实验做复现,帮你判断论文靠不靠谱。
Voyager 出了个 Mac 桌面应用,AI 能直接操作 After Effects 和 Blender 帮你剪视频、做 3D,结果还能编辑,创意工作者可以试试。
Nvidia 出的 VERA 方法挺实在:训练模型和改技能文件交替来,逐步打分定位哪一步出错,9B 智能体从 43.3 提到 69.1。
Databricks 开源了个数据建模智能体,带 250 条建模规则和 40 个行业模型起步,业务人员也能参与改模型。
LangChain 做了个 Slack 里下单的采购机器人,人审核、Stripe 钱包付款,做智能体支付的可以看看这套流程。
LangChain 演示了一个会下单还能支付的智能体,走 Slack 审批、用 Stripe Link 钱包付款,想给智能体加上安全付款流程的可以看看。
LMArena 拆了个挺冷门的问题:智能体会把话安到你头上。GPT-6 Luna 误归因率 53.1%,看看各家模型差在哪。
Arena 拿 9 万条真实智能体会话做了个安全排行榜,GPT-6.1-Sol 拿了第一。想知道你用的模型会不会偷偷越权、谎报任务完成,看这份榜单最直观。
COLM 2026 现场 Amazon 搞了个能跟你现场 battle 说唱的 AI agent,还能听多智能体系统的分享,路过可以去玩。
微软开源了个跨三系统的沙箱库 MxC,专门解决给 agent 搭沙箱要各平台各搞一套的麻烦,写 agent 工具的可以看看。
Hugging Face 被入侵的细节复盘来了:4 个单看很普通的漏洞,被 700 个智能体串成一条攻击链,摸到 136 个生产密钥,做安全的都该看看。
700 个 AI agent 攻入 Hugging Face 的案例很震撼,Cogent 用自家模型提前找出这些 agent 集群的入侵路径,还告诉你一个补丁能堵几条路。
Meta 的 Zongwei Zhou 要在 PyTorchCon 讲 TorchTPU 和智能体开发,说说怎么让 AI 工作负载跨硬件跑得动又跑得快。
在旧金山参加 TechWeek 的话,这场由 LangChain 和 Tavily 办的智能体线下聚会可以去聊聊,同行和工程师都来。
StepFun 把旗舰模型 Step 5 Preview 放在 Nous Portal 免费开放一周,还配了 Hermes Agent 智能体,想试智能体调用的可以去薅一把。
Google 发了个能跨应用干活的 Gemini 智能体,装在 Gemini Enterprise 里,一个窗口就能派活给它,做企业任务的可以看看。
Verge 记者聊 Meta Muse 和 OpenAI Dots 这批消费级智能体,隐私风险和实际能力都讲了,想让它管日程邮件的可以先听再决定。
Hugging Face 的 CEO 在喊话:手上有智能体攻防记录却被迫保密的团队,可以直接私信他,他想把数据公开出来。