11:24官方一手arXiv: DeepSeek@Zhongchao Zhou, Yixuan Xie, Wenwei Yu, Yuxi Lu, Yaonan Zhu, Qian Niu, Yutaka Matsuo, Yusuke Iwasawa精选论文提出CoDyControlBench基准,包含132个系统配置,覆盖自由度、系统类型、耦合度等五个维度。评估了GPT、Gemini、Claude、GLM、DeepSeek、Qwen六款模型,GPT设计成功率最高达94.8%,Qwen最低为50.0%。分析显示自由度与控制器类型对成功率影响最大,差距主要来自增益选择与瞬态限制机制。通过推理蒸馏得到1.5B参数模型,在基准上胜过答案蒸馏模型,并在气动人工肌肉机械臂的三次物理试验中全部成功跟踪目标。论文CoDyControlBenchGPTQwen推荐理由:论文搞了个新基准CoDyControlBench,测了6款模型,GPT成功率最高94.8%,还蒸馏出1.5B小模型能上机械臂干活。原文稍后读已读值得跟进有用关注 CoDyControlBench