全部 AI 动态 · AI 热点

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？

6月4日

10:26

10:26

arXiv cs.AI@Guangyao Dou, William Jurayj, Nils Holzenberger, Benjamin Van Durme

道义推理是指根据明确规则和策略回答特定案例问题的任务，例如计算税务或移民上诉结果。LLM在此类任务中常因规则集过长且交叉引用而失败。论文提出Deontic Agentic Reasoning (DAR)，一种让模型按需与法规交互的智能体推理框架。在DeonticBench的困难子集上测试发现，智能体框架能提升道义推理上限，但效果不均衡：弱模型在数值任务上表现下降且消耗更多token。

论文道义推理智能体 LLM 规则推理 DeonticBench

推荐理由：做法律、税务等规则密集型应用的开发者，可以看看DAR如何用智能体框架解决LLM的长规则定位痛点，值得关注其设计思路。