AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

指称消歧

共 1 条相关 AI 资讯
8月14日
12:02
12:02官方账号arXiv cs.AI@Dananjay Srinivas, Saksham Khatwani, Maria Pacheco
这篇论文受格莱斯合作原则启发,提出LLM在遇到未知实体时应从具体表述撤退到更安全的泛化表述。作者基于T-REx构建基准,改变实体熟悉度和指称特异性,探测模型内部激活是否编码了知识边界和待生成指称的特异性。结果显示两种信号都存在,但生成时模型仍偏好具体指称,即使提供正确的泛化选项也如此。这表明实现Gricean退避所需的基本表征已具备,但缺少将其转化为生成策略的机制。
论文T-RExLLM知识边界

推荐理由:这篇用探针方法拆开了LLM一本正经胡说八道的原因:模型内部其实知道自己不知道,但嘴硬不肯说泛话。
原文
精选全部日报登录