Anthropic 出了份报告,讲有人拿代理偷偷转发用户 prompt 到 Claude API 蒸馏模型,还点出隐私风险,做 AI 产品的人都该看看。
全部动态
LangChain 9月30日有场直播,教你用 LangSmith 的 Tuned Evaluators 自动给生产环境的 agent 交互记录加反馈,做线上评估的可以看看。
Pat Loeber 和 timeyoutakeit 写了份 Gemini API 教程,拆了 skills 怎么接进编程智能体,还讲了 Live API 和 Omni,写代码的可以看看。
Runway 一周后办 AI Summit,Nvidia、DeepMind、Wayve 的人要同台聊物理世界里的智能,做视频或世界模型方向的可以关注下议程。
Weaviate 写的 Engram 记忆调优指南,讲了记忆该存什么、怎么检索、放提示词哪里,还教你怎么不弄坏 prompt 缓存,做智能体的可以照着调。
Anthropic 给 Opus 5.5 出的官方用法说明:effort 默认 medium 就够用,速度还快 30%,Agent 中途停顿别掐断,是在汇报进度。
阿里 Qwen 出了三个手机智能体,能规划任务、操作手机、一句话生图,还把测试基准开源了,做移动端 Agent 的可以看看。
Claude Opus 5.5 在 FrontierCode 编程基准上,思考档位调到 med 和 max 成绩差不多,还比 high 高,省钱党可以看下再选档位。
阿里 Qwen 把语音识别、合成、实时对话打包成五个模型一起发,ASR 最高打 0.5 折,做播客或有声书的可以试试 TTS-Next。
不想一条条刷九家公司的更新,看这个视频汇总就行,几分钟把 OpenAI、Anthropic、Perplexity 这周的动作都过一遍。
这条汇总了几个小更新:Grok Build 的 MCP 返回结构化 JSON,Perplexity 能在 24GB 显存的电脑上本地跑,还有 Copilot 选模新档位。
Meta 的 Muse 这周把 ChatGPT 挤下美国 App Store 榜首了,Meta 终于在消费端赢了一回,看看它到底做了什么。
Goldman Sachs 给了一组数字:2026 年美国云厂商 AI 资本开支约 8060 亿美元,中国约 1100 亿,差 7 倍多,但模型差距没拉那么开,值得看看原因。
Goldman 拆了组数据:美国 2026 年 AI 资本开支约是中国 7 倍,但 DeepSeek V4.1 Flash 把 KV-cache 省了 437 倍,看效率派怎么打。
Anthropic 给 Opus 5.5 出的官方调参清单,从 effort 挡位到防假完成都有,老用户升级前值得照着改一遍自己的 harness。
独立开发者 idoubi 新做的 douchat.ai,把 codex、claude code 这些 Agent 拉进群聊互相调用,还能和真人朋友共享,跟 Grok Bot、ChatGPT 那种单聊完全不是一个玩法。
GitHub Podcast 这期专门回应了三个大家争论的点:AI 代码要不要人工审查、RAG 是不是没用、Skills 有没有取代 MCP,想搞清楚这些说法的对错可以听听他们的分析。
Hamel Husain 和 Shreya Shankar 跟 50 多家 AI 公司合作后写的评估方法论,还附了个免费插件让编程 Agent 帮你搭评估,做产品的都该看看。
Tinder 联创写的分析,讲 Meta 的 Muse 怎么让 AI 智能体替你开 App,从而绕开 Apple 的抽成,角度挺有意思。
Meta 弄了个叫 Muse 的 AI 代理,想让 AI 替你操作 App,直接绕过 App Store 收费站,背景是 Apple 当年让他亏了 100 亿美元。
OpenAI 把 GPT-6 Astra 的能力塞进了两个更快更便宜的模型,API 价格直接砍半,Genspark 上已经能用了。
Anthropic 新模型 Opus 5.5 已经能在 Genspark 里直接用了,比 Opus 5 便宜四成还快三成,写代码和聊天都可以试试。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档