#OLMo
共 9 条 · 7 天 2 条 · 30 天 3 条
信息流里打上「OLMo」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月8日
10月4日
10月2日
9月1日
8月11日
7月10日
论文11:44
超级权重在LLM中并非普遍关键,单独训练导致随机猜测这篇论文打脸了“超级权重”的主张:单独训练它们反而让模型崩成随机猜,而LoRA用极少的参数就能搞定。想了解模型微调真正该关注什么,必看。
7月3日
6月16日
这篇论文打脸了“超级权重”的主张:单独训练它们反而让模型崩成随机猜,而LoRA用极少的参数就能搞定。想了解模型微调真正该关注什么,必看。