主要来源arXiv: Anthropic
查看原文事件专题 · 官方一手
LLM 法律问答的时间失效模式:诊断与缓解
大型语言模型在静态知识截止日期与动态法律条文之间存在根本矛盾,导致两种时间失效模式:一是模型在立法修订后仍使用旧规则(后截止日期失效),二是模型偏好新条款而忽略历史版本(近因偏差)。研究者构建了包含312个专家验证的德语法律问答基准,涵盖三类时间敏感问题,并评估了OpenAI、Anthropic和DeepSeek的五种模型。实验发现,在无辅助的推理设置下,模型在后截止日期场景中表现严重下降;检索增强生成(RAG)方法通过提取事实日期和版本过滤显著提升所有问题类型的准确性,而网络搜索则不稳定且加剧近因偏差。研究结论指出,可靠的法律问答必须将时间有效性作为硬约束。
当前结论
法律从业者和AI开发者会关心:LLM 在法律场景中的时间失效问题直接关系到合规风险,RAG 方案已被证明能有效缓解,值得在实务中尝试。
11 个信源58° AI 热度最后更新 2026/5/22 11:02:01
证据链
相关来源 1lmarena.ai
查看原文相关来源 2Thomas Wolf
查看原文相关来源 3OpenAI
查看原文相关来源 4Greg Brockman
查看原文相关来源 5shao__meng
查看原文相关来源 6Pandaily
查看原文相关来源 7IT之家
查看原文相关来源 8marktechpost
查看原文相关来源 9Jerry Liu
查看原文相关来源 10The Rundown AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。