模型中美对照精选76°02:33Fireworks AI 与 MiniMax 开源稀疏注意力内核,吞吐量提升1.6倍Fireworks 和 MiniMax 把稀疏注意力内核开源了,实测吞吐快了1.6倍,搞推理优化的不可错过。#Fireworks AI#MiniMax#MSA#稀疏注意力Fireworks AI@FireworksAI_HQ原文稍后读已读值得跟进有用关注 Fireworks AI
模型中美对照官方一手精选23:33MiniMax发布MSA:两分支稀疏注意力,1M上下文计算量降28倍MiniMax 搞了个新稀疏注意力 MSA,1M 上下文计算量降 28 倍,准度却一点没掉,适合长文本场景。#MiniMax#MSA#稀疏注意力#长上下文官方一手marktechpost@Asif Razzaq原文稍后读已读值得跟进有用关注 MiniMax