RedNote says its new open-source AI model bests DeepSeek in Chinese | RedNote称其新开源AI模型中文表现优于DeepSeek

中国社交媒体平台小红书(RedNote)近日开源了其首个大型语言模型dots.llm1,成为众多科技巨头中积极布局人工智能市场的又一重要玩家。该模型采用混合专家系统设计,在响应查询时激活1420亿参数中的140亿,旨在实现与领先AI模型相当的性能,同时降低训练和推理成本。dots.llm1由小红书旗下的Humane Intelligence Lab(hi lab)自主研发,该团队由公司原有的AI研究团队发展而来。

小红书拥有3亿月活跃用户,近期私募市场交易显示其估值已达到260亿美元,超过了2021年疫情期间的峰值,预计今年有望启动首次公开募股(IPO)。今年6月7日,小红书在香港铜锣湾时代广场开设了首个中国大陆以外的办公室,标志着其国际化战略的重要一步。公司在海外知名度提升,部分原因是美国可能禁止字节跳动旗下TikTok,推动了小红书的海外扩张。

近年来,中国大型语言模型发布数量激增,开源模型逐渐成为趋势,阿里巴巴、腾讯和字节跳动等科技巨头纷纷投入巨资训练基础模型。小红书的Humane Intelligence Lab今年特别注重招聘具有人文背景的研究人员,强调模型表达的人性化及与人类价值观的契合。公司表示,dots.llm1在中文理解能力上超过了阿里巴巴的Qwen2.5-72B-Instruct和DeepSeek-V3等领先开源模型。

via SCMP Full Text Feed
 
 
Back to Top