论文Agent 与开发者多源确认精选09:21一种无需重新训练的模型知识移除方法这个方法挺有意思,不用改模型权重就能移除特定知识,在DeepSeek和Gemma上效果还不错,感兴趣的可以看看。#Test-Time Unlearning#大语言模型#知识移除#Gemma-32 个信源在谈事件专题aarXiv: DeepSeek@Pingzhi Li 等 9 人3 个信源在谈原文稍后读已读值得跟进有用关注 Test-Time Unlearning
论文Agent 与开发者精选73°09:23对抗性微调中的预防性转向研究清华团队发现预防性转向依赖主动适应而非静态防御,提出新方法提升模型安全性。#Preventative Steering#Qwen2.5#Gemma-3#对抗性微调aarXiv cs.AI@Jing Guan 等 6 人原文稍后读已读值得跟进有用关注 Preventative Steering
技巧Agent 与开发者官方一手精选12:36使用Tunix GRPO和LoRA微调Gemma-3进行数学推理手把手教你用Tunix GRPO和LoRA微调Gemma-3做GSM8K数学题,奖励函数设计得很清楚。#Gemma-3#GSM8K#GRPO#LoRA1 个信源在谈事件专题官方一手marktechpost@Sana Hassan2 个信源在谈原文稍后读已读值得跟进有用关注 Gemma-3
论文精选10:07LOCOS:用分散贡献评分检测非字面检索注意力头这篇论文告诉你怎样用 LOCOS 找出模型里真正干活的注意力头,在长上下文检索任务上效果拔群,比旧方法准很多。#LOCOS#Qwen3#Gemma-3#OLMo-3.1aarXiv cs.LG@Aryo Pradipta Gema 等 3 人原文稍后读已读值得跟进有用关注 LOCOS