全部动态
AI 相关资讯全量信息流 · 6327 条
9月1日
TIDE-Bench评估LLM在对话式Text-to-SQL中的表现
研究人员发布了TIDE-Bench基准,专门测试LLM在复杂对话SQL中的意图理解能力,发现现有模型在链式识别和意图漂移处理上仍有明显不足。
8月31日
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档
研究人员发布了TIDE-Bench基准,专门测试LLM在复杂对话SQL中的意图理解能力,发现现有模型在链式识别和意图漂移处理上仍有明显不足。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档