#编程助手
这个框架挺有意思,它把大语言模型的决策和具体的无人机技能(比如搜索、检查)给连接起来了,让无人机群组能更灵活地执行任务,而且不需要中央控制,通过经验数据在线更新技能,挺实用的。
Shopify 商家现在可以直接在 ChatGPT 里给客户做广告了,不用自己花钱找广告公司,还能自己控制预算和怎么展示,挺方便的。
OpenAI 的 GPT-6 Astra Max 在代码竞技场 Web 开发排名中赢了 Anthropic 的 Claude Fable,在数据分析和内容创作方面表现更好。
Devin 新增了 Code Scans 功能,能帮你自动检查整个代码库,判断哪些代码可以安全删除,或者找出影响性能的查询,比手动检查效率高得多。
Anthony Fu 新出的 Devframe 框架,能帮你把一个 devtool 定义一次,就能变成 Vite 插件、独立 CLI 等多种形态,还支持 AI 代理使用,挺方便的。
朋友,Browser Use 这两年证明,模型越强,我们给它的“束缚”就越应该少。他们从人工定义动作,一步步拆掉中间层,最后给模型一个能直接写代码的浏览器接口,效率提升还很大。
豆包大模型 2.1 Pro 新版本更新,Agent 能力提升,能多源交叉验证,减少幻觉,对金融投研有直接价值;还能看图写代码,直接还原 28 万行 Java 代码,对开发者很实用。
火山引擎的豆包大模型更新了,Agent 交付更可靠,多模态 Coding 能力也进化了,适合做金融投研、办公自动化这些长报告任务。
OpenAI 给开源项目维护者发钱,用 AI 工具分担重复劳动,名额翻倍了,想申请的赶紧去申请。
GitHub Copilot 新增「我的工作区」功能,帮你集中管理代码仓库的 pull request 和 issue,不用再在不同页面来回切换了。
谷歌新出的Gemini 3.8 Live Extended Thinking版本,编程辅导能力更强了,能实时理解代码和屏幕,还能自动处理多种语言,比之前版本好用。
腾讯新出的 EvolveScaler 模型,能通过逻辑状态机生成可执行文本,比普通模型在 8 个基准测试上平均提升 5.25 分。
作者分享了自己从零构建代理框架的经验,核心是将其分为LLM模块、工具模块和代理循环三部分。推荐使用OpenRouter支持多模型,并建议通过ReAct实现基本循环。作者强调要记录实验过程中的输入输出,并使用多样化的任务进行测试。
Bolt Forge 推出 GLM、DeepSeek、Kimi,提供 50 倍使用量,让开发者有更多机会测试和构建应用。新功能免费使用至 10 月 14 日,零使用费。
Anthropic用视频展示CLaude Tag如何自动处理工程师夜间值班,能快速定位问题、推荐方案,但修改代码仍需人工批准,是一种自动化值班方案。