一句话看懂:AMD发布Instella-MoE-16B-A3B,这是一个完全开源的混合专家大模型,总参数160亿、激活参数仅28亿,并在AMD自有Instinct GPU上完成训练,试图以更低推理成本进入开源大模型竞争。
事件核心:发生了什么
据MarkTechPost报道,AMD正式发布Instella-MoE-16B-A3B。从模型名称和已公开信息看,这是一款采用混合专家(MoE)架构的语言模型,总参数规模为160
AMD发布Instella-MoE-16B-A3B,这是一个完全开源的混合专家大模型,总参数160亿、激活参数仅28亿,并在AMD自有Instinct GPU上完成训练,试图以更低推理成本进入开源大模型竞争。
一句话看懂:AMD发布Instella-MoE-16B-A3B,这是一个完全开源的混合专家大模型,总参数160亿、激活参数仅28亿,并在AMD自有Instinct GPU上完成训练,试图以更低推理成本进入开源大模型竞争。
据MarkTechPost报道,AMD正式发布Instella-MoE-16B-A3B。从模型名称和已公开信息看,这是一款采用混合专家(MoE)架构的语言模型,总参数规模为160