本土快讯2024.05.29

浪潮信息发布“源2.0-M32”开源大模型

浪潮信息推出“源2.0-M32”大模型,采用“基于注意力机制的门控网络”技术,构建32个专家的混合专家模型(MoE),显著提升了算力效率。M32在仅激活37亿参数的情况下,达到了与700亿参数LLaMA3相当的性能,所消耗算力仅为LLaMA3的1/19。

朋克君
发布者朋克君
预计阅读 1 分钟
我要投稿

浪潮信息发布了“源2.0-M32”开源大模型。该模型在源2.0系列大模型基础上,采用了“基于注意力机制的门控网络”技术,构建包含32个专家的混合专家模型(MoE),并大幅提升模型算力效率。M32凭借特别优化设计的模型架构,在仅激活37亿参数的情况下,取得了和700亿参数LLaMA3相当的性能水平,所消耗算力仅为LLaMA3的1/19。

RELATED STORIES

继续阅读

围绕「源2.0-M32」,继续阅读相关内容。

ARTICLE RECORD

转载说明

转载请注明文章出处。

TOPICS · 04

文章标签