DeepSeek speculation swirls online over Chinese AI start-up’s much-anticipated R2 model | 中国AI初创公司DeepSeek备受期待的R2模型引发网络热议

中国初创公司DeepSeek的新一代开源人工智能模型DeepSeek-R2引发了社交媒体上的广泛猜测。市场对其即将发布的这款推理模型充满期待,尤其是在中美科技竞争日益激烈的背景下,该公司在技术进展方面一直保持神秘。最新的猜测包括R2即将发布,以及其在成本效益和性能方面所设定的新基准。

此前,DeepSeek在2024年12月底至2025年1月期间连续发布了V3和R1两款先进的开源AI模型,以远低于大型科技公司通常所需成本和算力的代价构建,引起全球关注,也因此提高了人们对DeepSeek的关注度。据社交媒体平台上的帖子称,R2采用了混合专家模型(MoE)架构,总计拥有1.2万亿个参数,据称其构建成本比OpenAI的GPT-4o便宜97.3%。MoE是一种机器学习方法,将AI模型划分为独立的子网络或专家,每个专家专注于输入数据的子集,共同执行任务,从而大大降低了预训练期间的计算成本,并在推理期间实现更快的性能。

via SCMP Full Text Feed
 
 
Back to Top