Lightspeed 的 Harsha Kumar 花一年走访 AI 助手创业者,总结出哪些方向有壁垒、印度市场该怎么切入,做助手类产品的都该看看。
全部动态
Lightspeed India 把 AI 助手市场重新画了一遍,新增不少印度公司,还说理想客户可能是整个家庭,不是个人。
有人把决策模型打包成了 Ollaya,本地跑 GLiClass、Laya 这些模型,还带 TypeSafe API,做分类和路由的可以试试。
教你让 Codex 用 Computer Use 盯着 Claude Code 干活,完事还能自动发插件商店,这个跨工具工作流挺有意思。
Meta 的 Muse 上线两周下载量超过了 ChatGPT 同期,能替你砍价、退订、下单,但只有 8% 的人敢把密码交给它,这组数据挺有意思。
Mollick 聊了个基准测不出来的事:Claude Opus 从 4.7 到 5 失去了原有"性格",5.5 又找回来了,用 Claude 的人应该有同感。
宝玉聊了个很实用的经验:别给模型塞模板,给设计规范让它自由发挥。配 Opus 5.5 只给 TTS 和 ffmpeg 就能做视频的例子,做提示词的都该看看。
Simon Willison 把让 Claude 做互动页面的提示词和全程记录都放出来了,想学怎么写提示词的可以直接抄作业。
Rails 之父 DHH 分享自己的真实数据:用了 AI 后 20 个月写的代码只有过去 21 年的一半,他把生产力倍数之争从 10x 抬到了 1000x。
这篇讲的是怎么让科研智能体把实验预算花在刀刃上,同预算下比 AutoResearch 奖励高 10.3%,尝试次数省一半,做法挺巧。
推特上有人爆料 OpenAI 要推云端 Agent 产品 o,主打云电脑思路,还提到 muse 可能是对手,感兴趣可以围观讨论。
Garry Tan 晒了他的修 bug 新姿势:Capy AI 的 GStack 加 /autoplan,背后跑 GPT-6,直接处理线上问题,做开发的可以看看。
有人拿 Claude Opus 5.5 逐帧渲染了一支中华文明史动画,提示词里连配乐 BPM 和纹样演变都写清楚了,照着抄就能玩。
宝玉晒了两个用 Claude Code 做的科普视频,Transformer 和 DINOv3 各一个,提示词原文都贴出来了,直接抄走就能让 AI 帮你做动画讲解视频。
Google 的编程工具 Antigravity 被网友吐槽后又把 /plan 规划模式加回来了,能让智能体先出计划再动手。
有人拿自建 harness 实测了 Jev 路由,性能能追平 GPT-6 Astra low,代价是跑得更久。文章还讨论了为什么公开基准分数别太当真。
Sinofsky 和 Levie 聊了个有意思的判断:让模型输出百分比再写 if 判断,比纯聊天接口靠谱多了,做开发的会很受启发。
Box 的 Levie 和 Sinofsky 聊了 Agent 集群怎么把企业安全打穿, swarm 像 DoS 攻击这个角度很少见,聊得挺具体。
Anthropic 和 OpenAI 都在降价,企业客户说花了更少的钱效果还不差,现场聊了不少实际用法,做采购的可以看看。
Sinofsky 聊了个挺扎心的预测:AI 合法但每个 Agent 动作都弹免责提示,欧洲可能带头这么干。这段对话里关于 Agent 权限和安全的讨论也很实在。
GrokBot 能让 Muse 帮它打电话还汇报结果,Instinct 和 Claude Code 也能接入,代码全开源,感兴趣的可以自己搭着玩。
Chamath 自己讲他怎么用定制 AI agent,比如谈判前算纳什均衡,还把基础模型包成了 microservices,思路挺具体。
Recraft V4.1 Flash 生成的角色不走“网红脸”路线,视角还挺有时尚大片感,作者把完整提示词公开了,做角色设计的可以直接抄作业。
OpenRouter 公布分类请求数据,Jev 拿下 27% 份额,把 DeepSeek V4 Flash 挤到第二,做分类任务可以关注下。
a16z 的 Martin Casado 聊了个有意思的观点:实验室都在造会聊天的存在,但软件其实需要一个从选项里挑答案的模型,Jev 就火了。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档