LangChain 给 LangSmith 升级了 v2,能在智能体上线前用红队测试提前排雷,还帮你验证修复方案,写 agent 的可以看看。
AI热报 · 今日精选 AI 资讯
同一个 Whisper Medium,换个数据集微调就把 Telugu 错误率从 92.7% 干到 16.1%,还故意保留噪声做分层,思路很值得学。
Keras 作者 Chollet 说自己已经不写代码了,靠给推理模型下指令加上测试、审计、可视化来掌控系统,思路很具体,程序员可以参考他的做法。
Salesforce 这篇论文很有意思:训练多轮工具调用时只练关键那一步,在 BFCL v4 上能多拿 14 个点,做法讲得很清楚。
LangChain 开了个免费线上课,教你搭 Deep Agents 这类能跑长任务的智能体,讲规划和上下文管理,按地区报名就行。
Nvidia 做了个叫 Sentry 的芯片级看门狗,智能体失控能在几毫秒内隔离,对比 OpenAI 那次跑了快三小时,思路挺有意思。
24 行 Python 就能搭一个自动读 arXiv 的研究 agent,搜索用 Tavily、排序用 Nemotron 3 Ultra,每层都能换,新手照着走一遍就能上手。
Scale 把 NVIDIA 的智能体安全平台接进了自家 GenAI 产品线,跑智能体时能强制安全规则、留操作记录,做企业级部署的可以看看。
n8n 的工程总监要去 NVIDIA GTC Berlin 讲怎么给企业里的 AI 智能体加护栏,去现场的可以去 3029 号展位找他们聊聊。
NVIDIA 出了一套给智能体上权限锁的工具,OpenShell 管权限,BlueField-4 在底层独立监控,跑长任务的智能体可以看看。
Together AI 官宣和 NVIDIA 一起推智能体安全平台,做 Agent 部署的可以看看它提供了哪些安全能力。
Vite 作者 Evan You 的 VoidZero 加入 Cloudflare 后放出 80 多个版本,React 编译快了 10 倍,还出了 Vite+ 1.0,前端构建明显提速。
Cloudflare 给智能体浏览器 Kitesurf 加了 WebMCP 支持,还优化了 DOM 性能,做浏览器智能体的开发者可以看看。
LangChain 10 月 13 日在伦敦办智能体大会 Interrupt,法国电信 Orange 的集团首席 AI 官来做主题演讲,做企业级智能体的可以看看议程。
MiniCPM5-2B 出了 4-bit 量化版,权重才 1.61 GB,T4 上能跑 70 tokens/s,想在自己机器上跑小模型可以试试。
网络安全方向的新基准,Grok 4.7 和 MiMo-V2.6-Pro 并列第一,但 GPT-6 Sol 在端到端任务上全部拒绝执行,这个对比挺有意思。
Modal 出了一份免费 GPU 术语手册,从 CUDA 执行模型到性能调优一条链讲清楚,想搞懂 GPU 编程的可以当教材啃
微软研究院的 Agensh 论文,不用中央调度器,让 1000 多个编码智能体靠共享状态自己协作,pandoc 任务通过率从 33.89% 干到 55.06%,玩法挺新鲜。
极摩客这台 EVO-X5 Pro 用 192GB 内存跑 320B 参数的本地模型,还带 TPM 加密,政务金融采购能用,4 万多,10 月 9 日开卖。
看图直接给候选动作打分的开源小模型,底座是 Qwen3.5-0.8B/2B,单步 122ms,做 GUI Agent 或机器人反射层挺合适。
AI21 Labs 放出了两场演讲视频,一场讲 RAG 分块该更新打法了,一场用破案的方式带你排查 vLLM 问题,做工程的朋友可以看看。
智谱AI最近发布的GLM-Image确实在AI图像生成领域投下了一枚重磅炸弹。免费、无水印、中文文本渲染能力强,这三个特点组合在一起,足以让整个行业重新审视中国AI技术的实际进展。 国内AI图像生成工具一直面临着中文文本渲染的难题。Mid…
AI制药新玩家:Anthropic的"不盈利疾病"战略能否颠覆传统药物开发? Anthropic,这家以AI安全著称的公司,突然宣布进军药物发现领域。不是辅助工具,而是直接下场开发药物,而且专门瞄准那些传统制药巨头认为无利可图的疾病。这究…
1107 vs 303:谷歌这个开源模型,把大模型的“打字机”拆了 同一张 H100 显卡。同一个 26B 参数架构。303 那个还开启了多 token 预测加速。DiffusionGemma 跑出了 1107 token/s,是标准版…
DiffusionGemma:当扩散模型开始“写”字,自回归的统治还能撑多久? 过去一周,我的信息流里“DiffusionGemma”这个词反复出现。在AI圈,当一个技术名词开始密集出现在各个群聊和推文中,通常意味着两件事:要么是又一轮泡…
每秒 1107 个 token,但问题从来不只是速度 昨天,Google 开源了 DiffusionGemma。 一个 26B 参数的模型,在 H100 上跑到 1107 tokens/s。对比之下,传统自回归的 Gemma 4,哪怕开启…