DeepSeek’s upgraded AI model absorbs reasoning feature in agentic shift | DeepSeek升级的AI模型吸收推理能力实现自主转变

中国人工智能初创公司DeepSeek于周四宣布,其新发布的V3.1模型支持“思考”模式和“非思考”模式,标志着公司迈出了“迈向智能代理时代”的第一步。这一变化意味着公司可能会调整研究重点,可能放弃备受期待的R2推理模型。此前,DeepSeek的“思考”模式由R1推理模型驱动,该模型在去年1月发布后引起了全球关注。

与之前的模型不同,V3.1模型采用了“一个模型,两种模式”的设计,显示公司或许不会再开发R1的后续版本。据公司在官方社交媒体上透露,V3.1模型的响应速度比去年5月更新的R1模型更快。DeepSeek由企业家梁文锋创立,起初是其量化交易公司的副项目,推动了中国开源AI的快速发展。然而,近期该公司用户有所流失,因为阿里巴巴等大型中国科技企业的开源模型(如Qwen系列)在国内外市场逐渐占据优势。

via SCMP Full Text Feed
 
 
Back to Top