#大语言模型

共 134 条 · 7 天 2 条 · 30 天 28 条 · 话题观测 →
信息流里打上「大语言模型」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
10月5日
10月2日
10月1日
9月30日
9月28日
9月23日
9月21日
9月19日
9月18日
9月17日
研究提出用含误导前提的数据训练大语言模型提升安全警惕性

朋友,这个研究挺有意思,作者不是直接教模型怎么拒绝有害指令,而是反过来,用一些故意有误导性的问题来训练模型,让它学会“留个心眼”,这样在遇到真正的安全威胁时可能更不容易被绕过。

arXiv cs.AI@Youjia Wang 等 6 人原文
9月16日
一种改进的模型蒸馏方法,通过时间信用分配提升大语言模型性能

这篇论文提出了一种新的模型蒸馏方法γOPD,它通过引入折扣时间信用分配来平衡长时程监督和优化稳定性。实验表明,该方法在数学和代码推理任务上,比现有方法有更稳定的提升效果。

arXiv cs.LG@Shiqi Liu 等 12 人原文
9月15日
9月14日
9月11日
9月10日
9月9日
9月8日
9月7日
9月4日
9月3日