论文11:20LLM掷骰子有多靠谱?概率推理能力大考想用LLM做决策或数据分析的开发者注意了——模型在概率推理上存在系统性漏洞,反直觉问题和提示误导能轻易让它翻车,建议点开看看测试细节,避免在实际应用中踩坑。#大语言模型#概率推理#基准测试#token偏差aarXiv cs.AI@Luca Avena 等 3 人原文稍后读已读值得跟进有用关注 大语言模型