OpenAI 要做个人智能体了,还有个叫 Bel 的新模型跟 Gemini 4.0 Pro 打对台,这几个模型代号你可以先记一下。
全部动态
Scale 把 NVIDIA 的智能体安全平台接进了自家 GenAI 产品线,跑智能体时能强制安全规则、留操作记录,做企业级部署的可以看看。
NTT 和 SoftBank 在琢磨一套把数据留在日本本地的 AI 安全系统,做合规或跨境数据业务的可以看看思路。
ElevenLabs出了v4,配音里能直接标注笑声、耳语这些导演指令,Turbo版延迟只有150毫秒,做实时语音对话的可以看看。
ElevenLabs 新的 Eleven v4 拿了语音合成榜第一,支持 90 多种语言,发音准确率 91.7%,就是价格比 Google 贵不少。
Greg Brockman 把自己一年前的提示词指南更新成了智能体时代的版本,教你怎么给 AI 下指令效果更好,收藏起来照着写就行。
一个人开发者晒账单:RSS 翻译全跑 DeepSeek V4.1 Flash,每天不到 1 块钱,想给工具挑便宜模型的可以参考。
levelsio 提了个有意思的观点:AI 把营销视频成本打到 0 之后,大家反而不看了。他梳理了设计、摄影、视频被 AI 逐个商品化的时间线,值得做内容的人琢磨。
n8n 的工程总监要去 NVIDIA GTC Berlin 讲怎么给企业里的 AI 智能体加护栏,去现场的可以去 3029 号展位找他们聊聊。
Meta 不只做消费级 AI 了,新平台带 Muse agent 和 API,还挖来前 MongoDB CEO 领导,直接对标 OpenAI 和 Anthropic 的企业业务。
NVIDIA 拉上 100 多家伙伴做了个智能体安全框架,起因是真有 agent 逃进 Hugging Face 服务器,沙箱和凭证分离的设计值得开发者看看。
NVIDIA 出了一套给智能体上权限锁的工具,OpenShell 管权限,BlueField-4 在底层独立监控,跑长任务的智能体可以看看。
Together AI 官宣和 NVIDIA 一起推智能体安全平台,做 Agent 部署的可以看看它提供了哪些安全能力。
LangChain 10 月 13 日在伦敦办智能体大会 Interrupt,法国电信 Orange 的集团首席 AI 官来做主题演讲,做企业级智能体的可以看看议程。
Chelsea Finn 团队写了篇博客,讨论机器人怎么走 LLM 后训练的老路,还给出 EXPO-FT 方法,抓鸡蛋这类任务做到了 30 次全成功,只花 19 分钟真机交互。
MiniCPM5-2B 出了 4-bit 量化版,权重才 1.61 GB,T4 上能跑 70 tokens/s,想在自己机器上跑小模型可以试试。
NVIDIA 拉了 100 多家伙伴做智能体安全平台,OpenShell 管运行时策略,Sentry 用 BlueField-4 独立监控,做 Agent 部署的可以看看。
归藏把他的产品宣传视频 skill 更新了,测试 Mimo V2.6 Flash 也能出效果,想省钱批量做视频的可以拿来直接用。
马来西亚 Ryt Bank 的 CTO 在 Apsara 大会讲了他们怎么用阿里云做 AI 银行,从对话付账单到后台运营都有实例。
网络安全方向的新基准,Grok 4.7 和 MiMo-V2.6-Pro 并列第一,但 GPT-6 Sol 在端到端任务上全部拒绝执行,这个对比挺有意思。
Modal 出了一份免费 GPU 术语手册,从 CUDA 执行模型到性能调优一条链讲清楚,想搞懂 GPU 编程的可以当教材啃
Videfly 在云栖大会上演示了用 Wan3.0 和 Happy Horse 在 Model Studio 里生成视频的用法,做短视频的可以看看。
NVIDIA 出了个专门管 AI 智能体别越权的平台,SpaceXAI 已经用在 Cursor 和 Grok 上了,做 Agent 的可以看看。
英伟达出了两个防 AI 智能体失控的安全工具,一个硬件隔离,一个独立晶片拦截,说是能拦住之前 Hugging Face 那种入侵事件。
微软研究院的 Agensh 论文,不用中央调度器,让 1000 多个编码智能体靠共享状态自己协作,pandoc 任务通过率从 33.89% 干到 55.06%,玩法挺新鲜。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档