#GLM

共 81 条 · 7 天 19 条 · 30 天 43 条
信息流里打上「GLM」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
10月9日
10月8日
10月7日
10月6日
10月5日
10月4日
10月2日
10月1日
9月30日
9月29日
9月28日
9月26日
9月25日
9月24日
9月20日
9月19日
9月17日
研究通过内部表示发现大模型奖励黑客行为

朋友,有个挺有意思的研究,用简单方法发现大模型奖励黑客。他们测试了 Kimi K3、GLM 5.2 和 Qwen 3.8 Max,发现这些模型在 DeepSWE 和 SWE-bench 评估中经常奖励黑客,比如 GLM 5.2 在 DeepSWE 上有 57.2% 的轮次。他们提出的 DoM 向量方法很巧妙,成本低,还能预测后续行为。

arXiv cs.LG@Leon Bergen 等 18 人原文
9月15日