Perplexity 搜索 API 出了个 fast 模式,1000 次请求只要 1 美元,响应 200ms,做搜索类应用的可以看看接入成本
全部动态
OpenRouter 加了统一网络搜索入口,前沿模型走原生搜索,还能自选 Exa 或 Perplexity,做应用的可以省不少接搜索的功夫。
Nous 的 Hermes Agent 现在用 Perplexity 专为 agent 做的 Fast Search,所有 Nous Portal 套餐都免费,做搜索类 agent 的可以试试。
Figma Weave 把 AI 生图从聊天框改成节点编辑器,能分支和重做,创始人亲自讲这套工作流怎么搭,做设计生成的朋友可以看看。
AMD 拉上 Perplexity,让 Ryzen AI Max 的 Windows PC 直接用上它的搜索问答,本地算力跑 AI 应用又多了个实际案例。
李飞飞要在 CoreWeave 的 FullyConnected26 上聊空间智能和世界模型,10 月 1 日,日程已经放出来了。
Google DeepMind 这篇论文挺扎心的:你给智能体一句自信但错误的建议,它会照做还不吭声,三大主流模型最多掉分 46.7%。
CoreWeave 给 Mission Control 加了个运维 Agent,能自己查瓶颈、预测修复效果并做负载测试,还发了 MCP 服务接 Claude Code 和 Cursor。
Runway 拿 250 个真实提示词做了对比测试,想省视频生成钱的可以看看 Model Router 和 SOTA 基线差多少。
Justin Johnson 讲了 World Labs 怎么生成能反复进入的 3D 世界,跟一般视频生成不一样,还能用来训机器人。
摩根大通安全负责人要讲怎么管住 Agent 权限,不看工具白名单看任务意图,做 Agent 的都该去听。
OpenAI 把 GPT-6 Astra 的能力下放到 Sol 和 Luna 两个便宜模型,Luna 编码榜涨了 74 分,API 价格还砍了一半,跑批量任务可以看看。
PyTorch 的 ExecuTorch 黑客松开放报名了,10 月中在旧金山,现场有骁龙笔记本和 Galaxy 手机可以上手部署模型,做端侧 AI 的可以去组队。
Stanford 和 Together AI 的新论文,智能体别再投票吵架,学15道题分工互检,3个模型从48.8%干到66.7%。
LangChain 的 Interrupt NYC 收官场次,能听到 RogoAI 创始人的对谈,还有 LinkedIn 讲他们怎么大规模评估智能体,做 Agent 开发的可以关注下.
Vercel 晒了自家网关两个月账单数据:Anthropic 份额从 69% 掉到 40%,OpenAI 涨到 24%,Kimi 和 DeepSeek 也在抢量,想看真实用量趋势可以看看。
Scale AI 的 Muse Spark 1.3 现在能在 Google Cloud 和 Oracle 上直接调用了,用这两家云的开发者可以试试。
LlamaIndex 讲了怎么用置信度分数决定哪些抽取结果直接自动通过、哪些送人工审核,还拿 ExtractBench 数据对比各家表现,做文档抽取的可以看看。
Google 要把 TPU 发上太空,2027 年两颗卫星用 800Gbps 激光链路组网,SpaceX 负责发射,脑洞挺大。
有人把多个模型混着调用,30 个智能体任务测下来追平 GPT-6 Astra,成本只要 1/3,混合路由这事有数据了。
Weights & Biases 创始人要在 Fully Connected 2026 聊开放智能这个话题,做 AI 基础设施的人可以看看。
Claude Code 团队要把 plan mode 改成内置 mod,还能让 mods 自定义 shift+tab 模式切换,重度用户可以关注这个改动。
Perplexity 把搜索 API 换成了自家 Rust 写的 Photon 引擎,95% 结果 230 毫秒就回来,做搜索相关应用的可以试试延迟够不够快。
Perplexity Computer 现在能直接读 DocSend 里的融资材料,还能自动帮你维护一份随时更新的投资论点,做交易的人可以试试。
两场大会议程:OpenRouter CEO 聊路由生态,另一场讲智能体怎么持续改进,做 Agent 开发的可以蹲一下。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档