全部动态
AI 相关资讯全量信息流 · 6327 条
9月17日
提出无限参数LLM架构,可实时生成权重适应新数据
这个研究挺有意思的,作者想解决传统LLM在运行时无法学习新知识的问题,提出的无限参数架构挺有创意,通过实时生成权重来适应新数据,比单纯用提示词或检索的方法可能更高效。
一种针对混合专家语言模型的专家剪枝方法 HOPE
研究团队提出的新方法 HOPE,通过考虑专家间的协同作用来优化混合专家语言模型的剪枝过程,在 122B 参数模型上测试,HOPE 在 50% 剪枝率下比 REAP 等方法性能更好,在代理任务上提升达 6.1%,证明了其有效性。
稀疏特征揭示视觉语言模型在有害表情包检测中的读出瓶颈
这个研究挺有意思的,用稀疏特征的方法分析了Gemini和Qwen在检测有害表情包时的表现,发现模型内部其实有相关证据,但读出机制出了问题,这个发现挺有深度的。
Stability-Guaranteed Arbitration of Autonomous AI Agents in O-RAN
这个研究很实用,解决了O-RAN系统中AI代理独立运行时可能出现的资源冲突问题,推荐给对通信和AI结合感兴趣的朋友。
研究揭示开源大模型在招聘中存在性别和种族偏见触发机制
朋友,这篇论文挺有意思的,它不是简单说大模型有偏见,而是具体分析了哪些语言触发器(比如代理性语言、排斥性编码)会导致偏见,还给出了一个具体的审计方法,对做招聘AI系统的人应该挺有参考价值。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档