8月12日
17:51
17:51官方账号arXiv cs.AI@Rahul Gupta, Abhinav Mohanty, Anaelia Ovalle, Anil Ramakrishna, Anubrata Das, Apurv Verma, Jwala Dhamala, Ninareh Mehrabi, Tharindu Kumarage, Yada Pruksachatkun, Yang Trista Cao, Kai-Wei Chang, Aram Galstyan
TrustNLP研讨会自2021年起与ACL系列会议联办,论文数从8篇增至41篇,六届共144篇。综述按六类信任维度分类,发现2025-2026年真实性主题占37%,公平性最稳定,可解释性呈U型回升。与ACL等约2000篇论文对比,TrustNLP主题分布接近领域平均水平。
推荐理由:想快速了解NLP信任研究六年的演变脉络,看这篇综述就够了,它把144篇论文的规律都总结好了。
7月8日
17:17
17:17量子位@量子位的朋友们
精选
阿里在2025年ACL大会上获得最佳资源论文奖,其提出的Agent评测框架BenchAgent包含5万+测试用例和20+真实任务场景。该框架通过自动化生成对抗性测试,将现有Agent基准的评估效率提升300%。论文首次系统解决了Agent行为空间过大导致的评测覆盖不足问题。
推荐理由:阿里拿奖的这篇论文,搞了个叫BenchAgent的新评测框架,专门测Agent行不行,覆盖真实场景多,你搞Agent开发可以看看。
6月29日
13:52