8月27日
09:27
09:27官方账号arXiv cs.AI@Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman, Cheston Tan, Leshem Choshen
本研究通过多语言自我对弈,量化了大型语言模型在不同语言中技能的不一致性。测试了三个模型在八种语言和六种游戏中的表现,发现同一模型在不同语言中的表现差异显著,包括胜负差距、无效动作和策略倾向。结果表明,技能差异是真正多语言模型发展中的主要障碍之一。
推荐理由:这篇论文揭示了大型语言模型在不同语言中的技能差异,对于理解多语言模型的发展具有重要意义。