DeepSeek’s disclosure of AI technical details praised by open-source community

中国人工智能初创公司DeepSeek公开了其低成本、高性能模型的详细技术信息,驳斥了对其成本虚报的指控,并受到了开源社区的欢迎。此举被视为该公司履行承诺的一部分,即本周开始发布五个开源AI基础设施项目。

DeepSeek已于周一和周二发布了名为FlashMLA和DeepEP的两个项目,旨在最大限度地提高芯片性能,以实现具有成本效益的模型训练和推理任务。通过开源模型训练技术和工作成果,DeepSeek有效地驳斥了对其训练过程造假的指控,并进一步巩固了其在开源AI领域的地位,此前该公司已发布了V3大型语言模型和R1推理模型,这些模型可与OpenAI和Anthropic等美国AI巨头的专有模型相媲美。

via SCMP Full Text Feed
 
 
Back to Top