全部动态
OpenAI 分享了两个超实用的 API 开关,GPT-5.6 Sol 在 ARC-AGI-3 上分数直接翻了三倍,token 还省了十二倍,搞推理优化的一定要看看。
别信什么神奇 prompt 了,这篇文章教你用 GitHub Copilot 的八步工作流真正提升效率,从 YOLO 模式到跨模型评审,实测可用。
作者做了两个PPT skill,经验很实在。他说Claude Opus做HTML比GPT好看,还对比了不同路线的优劣势,想省成本又出效果可以看看。
OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 上表现差是因为 API 设置没开对。改两个参数分数涨三倍,token 省六倍,学起来很实用。
如果你用Agent做编程助手,这个思路很实用:别让Hook自动commit,让Agent自己判断什么时候该提交,省得一堆垃圾commit。
Similarweb分享了一套实用评估框架,用确定性检查+LLM评分+忠实性对比搞定开放性问题评估,还能用LangSmith追踪。
LangChain出了个实用新课,手把手教你怎么用LangSmith Engine自动修bug、加测试,省时省力,搞智能体开发可以看看。
Ranking on AI 创始人 Tanya 亲授,教你让 ChatGPT、Claude 推荐你的 SaaS,转化率比自然搜索高 23 倍,实操性强。
推荐用 Atuin 审计 Agent 命令,能按 Agent 筛选历史,配合 Gitleaks 定时扫描,防止 Token 泄露,适合 YOLO 模式用户。
用 Codex 调 tldraw 一句话就搞出 3D 地球,还能做看板和 Todo,画布秒变应用开发神器,对做教学演示或快速原型特有用。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档