模型Agent 与开发者官方一手75°21:35Claude 3.5 Sonnet 在 SWE-bench Verified 上刷新纪录Claude 3.5 Sonnet 在 SWE-bench 上的突破意味着 AI 编程助手离真正解决复杂工程问题更近了一步,做软件开发的团队可以关注这一能力提升对日常代码修复和功能开发的潜在影响。#Claude 3.5 Sonnet#SWE-bench#代码修复#基准测试10 个信源在谈事件专题A官方一手Anthropic: Engineering11 个信源在谈原文稍后读已读值得跟进有用关注 Claude 3.5 Sonnet