论文09:29概率校准能否减轻LLM智能体反馈循环中的偏好耦合?这篇论文实验发现,对评估器做概率校准能把偏好耦合降低20-49%,效果显著,推荐给做LLM评估管线的朋友。#DeepSeek-V4-Pro#GLM5.2#TTRL#偏好耦合aarXiv: DeepSeek@Zewen Liu原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro