10:17官方账号arXiv cs.AI@Debarpan Bhattacharya, Malay Phadke, Sriram Ganapathy精选73°研究人员提出BiG-SURE,一种基于跨温度语义一致性的不确定性估计方法。该方法通过构建锚点-探针二分图,使用NLI蕴含分数计算置信度。在文本QA、多语言QA和多模态QA任务中,BiG-SURE在黑盒模型设置下提升了平均弃权AUROC。论文BiG-SURELLMsVLMs推荐理由:BiG-SURE能帮你评估黑盒大模型的不确定性,无需访问模型参数,简单实用。原文稍后读已读值得跟进有用关注 BiG-SURE