18:38官方一手arXiv: DeepSeek@Francisco León Zúñiga Bolívar一项研究比较了DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5和GLM-5.1四个中国前沿模型在进化囚徒困境中的合作倾向。通过固定代码转换器为GPT-5.4 Mini,排除了编码能力干扰,发现各模型攻击性均衡比例从Qwen3-Max的1%到DeepSeek V4 Pro的9%不等。四个实验室间的差异(8个百分点)大于中国与西方生态系统的均值差异(5.0%对5.0%)。研究支持H6假设,即中国模型并非单一整体,实验室层面而非生态系统层面决定合作倾向。论文DeepSeek V4 ProQwen3-MaxKimi K2.51 个信源在谈事件专题推荐理由:想知道中国大模型是不是都一个样?这篇论文用囚徒困境测了DeepSeek、Qwen、Kimi和GLM,发现它们合作倾向差别挺大,别再把它们当铁板一块了。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro