Google 给 Gemini 加了代打电话功能,Pixel 11 美国用户订阅后就能让 AI 替你给商家打电话订东西,有点像 Siri 打 reservations 那个思路。
全部动态
搞 PyTorch 或开源 AI 的朋友看过来,10 月 20-21 日 San Jose 两天大会,能跟维护者和贡献者当面聊。
OpenAI 给 ChatGPT 语音加了插件支持,还能跑 GPT-6 的三个模型,动嘴就能写文档、建表格、查邮件。
Toyota 把几十年制造知识接入 AI,但数据不能出内网,靠 Pinecone BYOC 解决。做企业 RAG 的可以看看这种部署模式。
Qualcomm 在 Snapdragon Summit 2026 上回应质疑:有了 Claude 和 Gemini,端侧芯片在 AI agent 时代到底干什么,这篇讲得挺清楚。
Recraft 的 V4.1 Flash 在 OpenRouter 能直接调了,一张图 1.3 秒才 7 厘美分,批量出图做 logo、概念稿都挺合适。
LangChain 在自家大会发布了 LangSmith Engine v2,能提前揪出 Agent 的问题,做 Agent 监控的可以看看。
LangChain 的 LangSmith Engine v2 来了,能给你的 Agent 做红队测试,还会自动验证修复方案,写 Agent 的可以看看。
DeepSeek Harness 出了官方客户端,Windows 和 Mac 都有,不用再敲命令行装环境了,想试的可以直接下载。
Tencent Cloud 把数据库数据做成可以像代码一样 fork 的分支,PB 级数据 1 秒克隆,跑并行实验不用再复制数据了。
腾讯云演示了自家 AI Gateway,把模型认证、限流、审计和一个入口管完,还兼容 OpenAI 协议,企业自建私有云的可以看看这套做法。
腾讯的 Hy Image3.5 预览版开放了四个入口,Miora 免费 to Oct 7,还能在 VOD 里直接生图,做图的可以试试文字渲染效果。
今天各家都在发东西:Meta 把 VR 做成眼镜,ChatGPT 语音能调插件了,Claude 开了应用市场,Qwen 的手机智能体真机成功率有 90%。
Meta 出了个叫 Muse Charm 的 AI 别针,别身上随时喊你的 Muse 智能体,12 月就发货,比 Humane Pin 那波靠谱多少得看看。
Meta Connect 快开了,传闻要开源 Muse Spark、上 Muse Video API,还有 Meta Glasses 版 Muse,消息量不小。
语音模式终于能装插件了,还换上了 GPT 6,直接在 ChatGPT Work 里用嘴干活,不用再开桌面 Remote session。
Google 把 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 开放进 AI Studio 和 API 了,能自定义声音、写剧本让两个角色对话,做配音的可以去试试。
OpenAI 给手机版 ChatGPT 加了语音智能体,Plus 和 Pro 用户能用 Work 页写文档、发邮件、总结 Slack 消息,还能建网站和幻灯片。
Anthropic 拿出湿实验室的首个成果,950 个 Claude agent 跑 21 小时真发现了一种噬菌体新酶,AI 做科学这事有实锤了。
OnSolo 出了个视频生成工具 Solo Video,一次能出 15 秒,主打开降低失败率,重试少花钱也少,比只拼时长的实在。
VoiceArena 搞了个 diarization 评测榜,12 款系统同题同规则比拼,还能看时间容差一变分数差多大,做语音的可以去看看。
有人分享了个后台小模型,发邮件或 Slack 消息前自动检查有没有违反公司政策,支持 Gmail 和 Teams,写错话之前先拦住你。
开源助理 OpenClaw 更新了,一次接入 Opus 5.5 和 GPT-6,还能记会议笔记、恢复中断任务,自己搭助理的可以看看。
Nous Research 给 Hermes 加了个桌面端,能实时看智能体操作浏览器和终端,输密码时还能随时接管,挺实用。
Anthropic 给 Claude Code 的 Projects 加了本地支持,threads 能直接跑在你自己电脑上,本地开发不用再连远端了。
CodeRabbit 出了个 Change Stack,能把一个 PR 的改动分层讲清楚,还告诉你影响范围,review 前先看它省不少劲。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档