09:27官方账号arXiv cs.AI@Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman, Cheston Tan, Leshem Choshen本研究通过多语言自我对弈,量化了大型语言模型在不同语言中技能的不一致性。测试了三个模型在八种语言和六种游戏中的表现,发现同一模型在不同语言中的表现差异显著,包括胜负差距、无效动作和策略倾向。结果表明,技能差异是真正多语言模型发展中的主要障碍之一。论文LLMs多语言模型技能差异推荐理由:这篇论文揭示了大型语言模型在不同语言中的技能差异,对于理解多语言模型的发展具有重要意义。原文稍后读已读值得跟进有用关注 LLMs