DeepSeek rival MiniMax says its first AI reasoning model halves compute of R1 | DeepSeek竞争对手MiniMax称其首款AI推理模型计算量减半

上海人工智能初创公司MiniMax推出了开源推理模型MiniMax-M1,该模型在某些任务中所需计算资源仅为竞争对手DeepSeek模型的一半。MiniMax于周二在其官方微信公众号发布了MiniMax-M1,并随产品发布了技术论文。根据论文,M1在处理生成长度不超过64,000个标记的推理任务时,计算功耗不到DeepSeek-R1的一半,这使得M1在推理和大规模模型训练中效率显著提升。

随着中国科技巨头和初创企业竞相开发先进推理模型以赶超DeepSeek,MiniMax-M1的发布显得尤为重要。MiniMax在技术论文中多次提及DeepSeek,显示出挑战这家杭州竞争对手的决心。第三方基准测试显示,M1在数学、编码和领域知识等方面的表现与谷歌、微软支持的OpenAI以及亚马逊支持的Anthropic等全球领先模型相当。

M1基于拥有4560亿参数的MiniMax-Text-01基础模型,采用混合专家模型架构以降低计算需求,这一设计理念与DeepSeek类似。同时,M1还运用了Lightning Attention技术,加快训练速度、减少内存使用,并支持处理更长的文本内容。

via SCMP Full Text Feed
 
 
Back to Top