16:07IT之家(博客/媒体)AMD于7月24日发布Instella-MoE系列模型,总参数量16B,激活参数量2.8B。该系列包含6个版本:预训练、Mid-training、长上下文、SFT、DPO、RL。性能上,Base版本低于Qwen3.5-4B-Base,但Think版本在2.8B激活参数下超越Gemma-4-E4B-it。模型在AMD Instinct MI300X和MI325X GPU上训练,基于ROCm软件栈及Primus训练和Miles RL框架。预训练速度通过FarSkip-Collective提升12.7%,推理TTFT缩短最多39.2%。AI模型Instella-MoEAMD开源模型推荐理由:AMD开源了自家GPU训的Instella MoE,Think版参数少但强过Gemma-4,值得看。原文稍后读已读值得跟进有用关注 Instella-MoE