论文Agent 与开发者10:38ECO:面向注意力-FFN 分离式 LLM 服务的能耗配置优化方法一篇降本干货:ECO 在 Qwen、DeepSeek 的分离式部署上实测省 40.5% 能耗,做 GPU 推理优化的可以看看方法细节。#ECO#LLM服务#贝叶斯优化#DeepSeekaarXiv: DeepSeek@Zou Qingyun 等 6 人原文稍后读已读值得跟进有用关注 ECO