模型Agent 与开发者多源确认精选09:20SpecQuant框架通过多父量化实现LLM自适应高效推理这个技术很实用,能让你在本地设备上更高效地运行大语言模型,不用复杂配置,还能根据任务自动选择合适的模型精度。#SpecQuant#Qwen2.5#推测解码#量化10 个信源在谈事件专题aarXiv cs.LG@Harish KB 等 5 人11 个信源在谈原文稍后读已读值得跟进有用关注 SpecQuant
论文10:39自适应推理:测试时计算分配学习这篇论文介绍了一种自适应推理模型,通过选择不同的推理模式来优化计算分配,这在处理不同难度的问题时非常有用,值得一看。#自适应推理#计算分配#MATH模型#推理模式aarXiv cs.AI@Gijs Kassenaar 等 3 人原文稍后读已读值得跟进有用关注 自适应推理
模型官方一手精选18:20傅聪团队与厦门大学提出ManCAR:流形约束自适应推理使推荐提升46%傅聪团队和厦大搞了个ManCAR新框架,做推荐比之前方法强了将近一半,用流形约束让推荐结果更准更靠谱。#ManCAR#傅聪#推荐系统#自适应推理官方一手Pandaily@[email protected] (Pandaily)原文稍后读已读值得跟进有用关注 ManCAR
模型10:33AdaR:自适应递归图模型实现测试时计算AdaR让图模型在测试时自己调整推理步数,不用重新训练,效果比传统图神经网络好。#AdaR#图学习#测试时计算#自适应推理aarXiv cs.LG@Junshu Sun 等 4 人原文稍后读已读值得跟进有用关注 AdaR