模型中美对照12:23DeepSWE 新基准发布:GPT-5.5 领先,小米模型表现亮眼这个基准测试解决了现有 coding benchmark 数据污染问题,做 AI 编程模型评估的团队可以直接参考排行榜,小米模型的表现值得一试。#coding benchmark#DeepSWE#GPT-5.5#小米Viking@vikingmute原文稍后读已读值得跟进有用关注 coding benchmark