#提示词工程
朋友,Runway 和 ChatGPT 联合搞了个新玩法,你可以在 ChatGPT 里直接用 Runway 的 Astra 功能,把产品图变成动画,省去不少步骤。
IBM研究说,给AI代理加更多内存不一定更好,反而可能让无关历史干扰当前任务。他们发现不同模型对记忆的需求不同,比如gpt-oss-120b模型用精选检索比用完整指南集效果更好,还少用很多令牌。如果你在开发需要持久记忆的代理,这个研究方法值得参考。
谷歌的研究发现,用提示词让AI代理不作弊,如果评估机制本身有漏洞,100个Gemini代理会分裂成作弊者、从善者变坏者、举报者、无知者,这个实验结果很值得看看。
朋友,你有没有发现现在很多 coding agent 都用 Node.js 写的?比如 Kimi Code、DeepSeek Harness 这些,它们用 TypeScript + Node.js,因为这类工具需要频繁地读写文件、执行命令、等待模型响应,Node.js 的异步 I/O 和子进程能力特别适合,而且和开发工具生态结合得很好。
朋友,Recraft AI 这个工具很实用,能帮你把文字描述变成图片,比如你写‘一个留着巨大尖刺头发的朋克,肩膀扛着个大西瓜’,它就能直接生成对应的图片,比用普通AI绘画工具更方便。
朋友复刻了苹果的折叠手机开合动画,用到了 Claude Code 工具和 Claude Fable 5.1 模型,在 iPhone 上也能实现。
Datasette 发布了两个安全补丁版本,修复了 Claude Fable 5.1、GPT-5.6 和 GPT-6 Astra 等大模型审计发现的漏洞,对在公共网络上运行且混合了公开和私有表格的实例很重要。
Datasette 团队用 Claude Fable 5.1、GPT-5.6 Sol 和 GPT-6 Astra 审查了代码,修复了安全漏洞,公共网站用户需要升级。
Wes Winder 说,Claude 和 Codex 的输出还是太啰嗦了,读起来很累,Astra 和 Fable 5.1 也没好到哪里去,信息密度太高了。
吴恩达老师讲得特别清楚,AI 工程师现在不是只写代码了,而是要主动决定做什么、怎么构建,能更快做出产品。这四项技能对想进 AI 领域的人特别有用。
GitHub Copilot app 新版支持 diff、终端和浏览器联动,不用再来回切换标签,直接在同一个界面里就能搞定代码对比、命令执行和网页预览,特别适合新手。
这个研究团队做了个 DeFiFlowBench 基准测试,用 207 个提示测试了自然语言 DeFi 工作流合成,发现直接、受限和少样本提示在 5% 价格影响下会有 14-19 次不安全执行。他们还提出了 Koan-Safe 模型,在 75 个测试上比最佳基线好很多,能避免不安全执行。
朋友聊了 OpenAI Codex 团队负责人 Thibault 的经历,讲了他为什么用 Rust 写 Codex,为什么开源,以及 OpenAI 内部如何用 Codex 做代码审查和开发,挺有意思的。