ByteDance says new AI technology boosts model training efficiency by 1.7 times

ByteDance宣布其大型语言模型(LLM)训练效率提升了1.71倍。这一突破由其Doubao开发团队实现,通过优化后的专家混合(MoE)系统COMET,显著提高了LLM的训练速度,并已应用于超过10,000个GPU的集群生产环境中,节省了数百万GPU小时。

MoE是一种机器学习技术,通过多个专家网络将问题空间划分为同质部分,已被广泛应用于扩展参数超过万亿的LLM,同时保持固定的计算成本。此次ByteDance的效率提升,可能会降低对英伟达高端GPU的需求,并已被Grok和DeepSeek等领先AI模型采用。

via SCMP Full Text Feed
 
 
Back to Top