模型18:03富士通介绍PHOTON框架:1.2B模型多查询性能475倍于Transformer富士通新架构PHOTON在多查询任务上比Transformer快475倍,1.2B小模型实测,省内存省GPU。#富士通#PHOTON#Transformer#推理模型IIT之家原文稍后读已读值得跟进有用关注 富士通