论文19:11SOL模型:动态分配推理计算预算该研究为推理效率优化提供了新思路,动态预算分配结合强化学习,可能在不牺牲质量的前提下显著降低计算成本。对部署大规模语言模型的企业和研究者有重要参考价值。#推理效率#动态预算分配#强化学习#量化/剪枝aarXiv cs.LG@Yash Akhauri, Mohamed S. Abdelfattah原文稍后读已读值得跟进有用关注 推理效率