论文11:44超级权重在LLM中并非普遍关键,单独训练导致随机猜测这篇论文打脸了“超级权重”的主张:单独训练它们反而让模型崩成随机猜,而LoRA用极少的参数就能搞定。想了解模型微调真正该关注什么,必看。#Super Weight#LoRA#OLMo#推理模型aarXiv cs.LG@Shreyas Subramanian 等 3 人原文稍后读已读值得跟进有用关注 Super Weight