#GPU优化
共 7 条 · 7 天 1 条 · 30 天 3 条
信息流里打上「GPU优化」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月8日
9月30日
9月29日
PEARL:面向智能体强化学习的自适应 Prefill-Decode 弹性执行系统
训练智能体 RL 的人可以看看:PEARL 动态调 prefill-decode 配置还能借闲置 GPU,吞吐比 RLBoost+ 最高多 36.3%。
9月6日
9月2日
5月13日
DeepSeek 开源 DeepEP:首个面向 MoE 模型的专家并行通信库
MoE 模型的通信瓶颈是训练和推理的常见痛点,DeepEP 直接解决了这个问题。做大规模 MoE 训练或推理的团队,值得集成试试。
5月11日
NVIDIA与SakanaAI合作:稀疏Transformer内核提速20%+
该工作展示了硬件厂商与AI研究机构在底层算子优化上的高效协作,直接提升了大模型训练/推理效率,对部署大规模Transformer模型的企业而言有显著成本降低潜力。