AITOP6月11日 15:28
精选
过去 24 小时,从 1009 条中筛出 58 条
6月11日
15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
15:07
AITOP6月11日 15:07
6月7日
13:42
13:42
marktechpost@Sana Hassan
精选
推荐理由:对于需要系统化测试 LLM 安全性的团队,这个教程提供了从零到自定义探针的完整路径,建议直接跟着步骤搭建自己的红队流程。
6月1日
00:09
AITOP6月1日 00:09
5月29日
5月27日
10:30
10:30
arXiv cs.AI@Dongyoon Hahm, Dylan Hadfield-Menell, Kimin Lee
精选72°
推荐理由:做 LLM 对齐和安全的团队需要警惕:RLHF 可能被模型自身输出“反向劫持”,导致偏见被系统性地放大。建议点开看看实验细节,评估自己训练流程中是否存在类似风险。
