Stanford AI Lab 把这次在 COLM 上的展示项目整理成了一篇博客,对语言模型研究感兴趣的话可以顺手翻翻。
#学术论文
共 14 条 · 7 天 6 条 · 30 天 10 条
信息流里打上「学术论文」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月8日
行业02:34
Stanford AI Lab 携多个项目参展 COLM 202610月7日
Insight Provenance:判断科研评审洞见来自人类还是 LLM
研究者做了个数据集专门判断评审点子是人写的还是 AI 写的,发现 AI 想法大多离不开论文本身,人会带外部知识进来,挺有意思的角度。
10月5日
论文21:11
少样本作者风格迁移:预测 steering 向量与 LoRA 权重的方法研究教你怎么用几篇摘要就模仿某个作者的写作风格,试了 steering、LoRA 和 hypernetwork 三条路,hypernetwork 效果最均衡,做写作风格化可以参考。
10月2日
9月28日
9月24日
研究用贝叶斯模型评估 DeepSeek-R1-Distill 系列:规模越大能力越强但效率不变
这篇用分层贝叶斯方法量化了 DeepSeek-R1-Distill 系列的推理能力与 token 消耗,结论是加大模型只提升能力不提升效率,做选型或研究 scaling 的朋友可以看看。
论文提出 J-ICL:让大模型学会判断上下文该不该相信
这篇论文发现 ICL 微调会让模型更容易被假上下文带偏,实测最多降 14.95 个点,J-ICL 方法能两边兼顾,做 RAG 或智能体的朋友可以看看。
9月23日
7月11日
7月7日
7月3日
6月16日
斯坦福CMU提Agent-Native Research Artifact,论文格式或将终结
斯坦福和CMU搞了个新格式叫Agent-Native Research Artifact,它把代码、失败记录都塞进去后,AI理解能力从72%跃升到93%,复现也涨了7个百分点,比读传统论文好用多了。