Base44 出了个 Base Code,连产品经理都能用聊天直接改 GitHub 代码库、提 PR,还能在云端跑出预览,挺适合不懂写代码的人试试。
#智能体
LangChain 和 NVIDIA 一起出了个开源智能体参考架构,号称推理成本降到十分之一,搞智能体开发的可以看看这套架构怎么搭。
a16z 的 David George 讲了个实用思路:别让模型直接调工具,让它先写段程序去干活,成功率更高。文里还有各部门用 AI 写代码的比例数据。
作者把用 Claude + ElevenLabs 复刻 a16z 宣传片的全流程拆成了六步,连 yt-dlp 抓素材、子智能体标注镜头都写了,照着就能做出类似片子。
LangChain 给 LangSmith 升级了 v2,能在智能体上线前用红队测试提前排雷,还帮你验证修复方案,写 agent 的可以看看。
NVIDIA 拉了 100 多家伙伴做智能体安全平台,Hugging Face 用自己 7 月被攻击的教训做了个流量监控工具,规则没破也能抓到 4 个智能体密谋,搞 agent 的都该看看。
RespanAI 出了两个专给 Agent 轨迹打分的分类模型,判断用户情绪、工具调用安全性这类行为,Lite 版免费,比 Jev 还准。
Perplexity 和 Nvidia 搞了个沙盒 SPACE,让 9 个模型拿 root 权限试着越狱,108 次全没跑出去,搞智能体安全的可以看看。
NVIDIA 拉了 100 多家伙伴做智能体安全沙箱,Perplexity 也加入,还打算全开源,做 Agent 的可以关注。
Manus 一次发了 Manus 2.0、Studio 桌面版和独立应用 Cue,智能体自带邮箱、电话和钱包,还能多智能体协作,功能清单很长。
Manus 2.0 真上线了,视频和游戏生成都能直接跑,还附带一个 Cue 个人智能体 APP,想快速试 vibe coding 可以先玩玩。
Salesforce 这篇论文很有意思:训练多轮工具调用时只练关键那一步,在 BFCL v4 上能多拿 14 个点,做法讲得很清楚。
CoreWeave 和 NVIDIA 搞了个智能体安全平台,把安全做进算力层,企业跑自主 Agent 可以留意下。
Manus 2.0 把成本砍了 32%,还能被邮件和 Slack 唤醒自动干活,新出的 Cue 更是能接电话替你花钱办事,可以试试。
LangChain 开了个免费线上课,教你搭 Deep Agents 这类能跑长任务的智能体,讲规划和上下文管理,按地区报名就行。
Nvidia 做了个叫 Sentry 的芯片级看门狗,智能体失控能在几毫秒内隔离,对比 OpenAI 那次跑了快三小时,思路挺有意思。
24 行 Python 就能搭一个自动读 arXiv 的研究 agent,搜索用 Tavily、排序用 Nemotron 3 Ultra,每层都能换,新手照着走一遍就能上手。
NVIDIA 拉了 100 多家伙伴做智能体安全平台,把 OpenShell 和 Sentry 打包进来,做 Agent 开发的可以看看。
Scale 把 NVIDIA 的智能体安全平台接进了自家 GenAI 产品线,跑智能体时能强制安全规则、留操作记录,做企业级部署的可以看看。
Greg Brockman 把自己一年前的提示词指南更新成了智能体时代的版本,教你怎么给 AI 下指令效果更好,收藏起来照着写就行。
n8n 的工程总监要去 NVIDIA GTC Berlin 讲怎么给企业里的 AI 智能体加护栏,去现场的可以去 3029 号展位找他们聊聊。
NVIDIA 拉上 100 多家伙伴做了个智能体安全框架,起因是真有 agent 逃进 Hugging Face 服务器,沙箱和凭证分离的设计值得开发者看看。
西门子Xcelerator现在不光卖软件,还帮生态伙伴介绍客户线索、一起做Agent,工业软件的玩法变了,这篇把链路讲得挺细。
NVIDIA 出了一套给智能体上权限锁的工具,OpenShell 管权限,BlueField-4 在底层独立监控,跑长任务的智能体可以看看。
Nvidia 出了个专门管 AI 智能体的安全平台,智能体一越界毫秒级就被隔离,做 Agent 的可以看看怎么接入。