模型09:30PUMA:相位-动量对齐诊断大推理模型推理病理这篇论文的PUMA框架能实时诊断大模型推理时是有效思考还是绕圈子,在1.5B到32B模型上准确率更高且更省计算,推荐给关心推理效率的朋友。#PUMA#大推理模型#测试时扩展#推理效率aarXiv cs.AI@Cheng Yan 等 7 人原文稍后读已读值得跟进有用关注 PUMA
论文精选75°19:12VPG-EA:变分后验引导提升LLM推理效率,缓解过度思考这篇论文为LLM推理效率问题提供了理论严谨且可落地的解决方案,做推理优化或模型压缩的研究者可以直接参考其变分蒸馏方法,值得细读。#推理模型#效率优化#变分推断#过度思考aarXiv: DeepSeek@Zizhao Chen 等 4 人原文稍后读已读值得跟进有用关注 推理模型