Lovable 发文讲他们怎么挑模型:每周实测新模型再决定路由,现已用上 GPT-6 Sol 和 Fable 5.1,想知道你的 AI 编程工具背后怎么选模型可以看看。
#编程助手
Cognition 把 Claude Opus 5.5 接入了 Devin,在 FrontierCode 1.1 上超过 Fable 5 拿了第一,成本还更低,写代码的可以去试试。
Anthropic 刚发了 Opus 5.5,编码和写作都很强,性能对标 Fable 5.1 但比 Opus 5 便宜 40%,可以上手试试。
Devin 现在能用 Claude Opus 5.5 了,在 FrontierCode 1.1 上反超 Fable 5 拿第一,价格还便宜不少,写码的朋友可以试试。
Cognition 自家的 FrontierCode 榜更新了,Claude Opus 5.5 拿 65.3% 超过 Fable 5,成本还更低,写代码的可以看看。
Anthropic 把新模型 Opus 5.5 设成 Claude Code 和应用的默认了,比 Opus 5 便宜 40%,额度还多 25%,Pro 和 Team 用户直接就能用上。
用 AWS 的开发者注意了,Anthropic 最强的 Opus 5.5 已经能在 Bedrock 上直接调用,博客里还有上手指南,写智能体应用可以试试。
LangChain 新出的 Managed Deep Agents,在 Slack 里 @一下 Patch,它就自己开好带 diff 的 GitHub PR,几行代码就能接进你的工作流。
Anthropic 新模型追平自家顶级模型,价格还砍了四成,缓存读取降到 0.2 美元,跑 Agent 的开发者直接受益,比 GPT-6 Astra 便宜一半以上。
Claude Code 更新到 v2.1.280,默认模型换成了 1M 上下文的 Opus 5.5,还顺手修了一堆 MCP 和终端交互的老毛病,天天用的人升级就对了。
Replit 和 Handshake 搞了个免费实战任务,一小时内在浏览器里做出一个真应用,做完直接放进求职主页给雇主看。
博主分享自己的多 Agent 编程工作流:Fable 写方案文档,Opus 照着执行再验收,比 plan 模式更好复用,值得抄作业。
Dify 新 Agent 上线了,聊着天就能搭出一个智能体,Preview 里直接试,搭好还能全团队用,视频两分钟看完流程。
用 Devin 写代码的可以试试 Grok 4.7,官方说它在难啃的后端工程任务上表现不错,FrontierCode Extended 拿了 59.4%。
Latent.Space 新一期采访 TypeSafe CEO Jev,聊为什么聊天机器人做不成可靠自动化,观点挺反共识。
Bitrig 跟进了苹果 iPhone Duo,做了个能折叠旋转的 3D 模拟器,铰链数据实时可测,想提前做折叠屏适配的开发者可以试试。
Lovable 创始人亲自安利:写 Web 应用时 harness 会自动在 OpenAI 和 Anthropic 模型间挑合适的,还自动带上调试数据。
小米三款 MiMo-V2.6 上线了,Pro 主打编程智能体,UltraSpeed 版输出快 10 倍,都在 OpenRouter 能调。
Devin 现在能调用 Grok 4.7 了,Cognition 实测它在难的后端工程任务上表现好,写后端的可以试试。
Arena 拆了 20840 条编码智能体反馈:69% 差评是代码跑不通,Fable 5.1 比 Astra 更少被吐槽。