事件专题 · 单一信源

微软新研究提升开源大模型代码推理表现

微软的新研究借助Agent Lightning v1.0框架,使开源大模型Qwen3.5 - 9B在代码推理基准SWE - bench上的通过率从41.8%提升至56.4%;该研究仅用约3500行代码实现模型与强化学习连接,优化训练流程;通过6K条训练示例和适度计算资源,模型在该基准表现提升14.6个百分点。

当前结论

微软这新研究,用简单方式让开源大模型代码能力提升,和之前比进步明显,值得看看。

2 个信源58° AI 热度最后更新 2026/8/19 14:08:01

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情