#LLM
共 791 条 · 7 天 48 条 · 30 天 186 条
8月31日
8月30日
8月29日
8月28日
8月27日
8月26日
8月25日
LLM-Enhanced Commit Message Generation via Issue Information: An Exploratory Study
研究ISAC框架,了解如何利用问题信息提升LLM生成提交信息的效果,与现有方法相比有显著提升。
8月24日
8月23日
8月22日
8月21日
论文11:11
InsufficiencyBench:评估LLM在用户查询不足方面的法律建议这篇论文介绍了InsufficiencyBench,这是第一个评估LLM在用户查询不足方面的法律建议的基准。它对法律AI系统提出了新的挑战,并提供了评估模型性能的新方法。
论文10:21
LLM缓存淘汰策略研究:LFU表现最佳研究人员用CLEVER框架测试了7种缓存淘汰策略,发现LFU在大多数情况下表现最好,而其他策略效果差距不大。他们还发现,实际可用的缓存命中率远低于理论值,因为很多命中答案不可替换。这个研究对优化LLM缓存很有参考价值。
8月20日
8月19日
8月18日
论文10:16
用反事实实验评估LLM行为解释:CHIVE方法这篇论文搞了个CHIVE自动找模型意外行为,结果发现现有可解释性技术对预测反事实行为没啥用,但用来训练数据倒挺能泛化,值得做可解释性的人看看。