How Alibaba builds its most efficient AI model to date | 阿里巴巴如何打造迄今最高效的AI模型
阿里巴巴集团旗下的阿里云近日发布了新一代大型语言模型Qwen3-Next-80B-A3B,该模型在保持与更大规模前代模型相当性能的同时,大幅缩小了体积,提升了效率和成本效益。该模型的尺寸比阿里巴巴此前发布的最大AI模型小近13倍,但在某些任务上的运行速度比今年4月发布的Qwen3-32B快10倍,训练成本则降低了90%。这一创新使得训练费用低于50万美元,远远低于谷歌2024年2月发布的Gemini Ultra模型约1.91亿美元的训练成本。
业内专家对阿里巴巴新模型的表现给予高度评价。英国初创公司Stability AI的联合创始人Emad Mostaque表示,该模型的性能超过了去年几乎所有模型。人工智能评测机构Artificial Analysis也指出,Qwen3-Next-80B-A3B在性能上超越了DeepSeek R1和阿里巴巴支持的初创公司Moonshot AI的Kimi-K2等最新模型。
阿里巴巴方面称,这一新一代AI基础模型代表了“高效大型语言模型的未来”,展示了在保持强大性能的同时实现模型紧凑化和成本优化的技术突破,进一步巩固了其在中国人工智能领域的领先地位。
via SCMP Full Text Feed
阿里巴巴集团旗下的阿里云近日发布了新一代大型语言模型Qwen3-Next-80B-A3B,该模型在保持与更大规模前代模型相当性能的同时,大幅缩小了体积,提升了效率和成本效益。该模型的尺寸比阿里巴巴此前发布的最大AI模型小近13倍,但在某些任务上的运行速度比今年4月发布的Qwen3-32B快10倍,训练成本则降低了90%。这一创新使得训练费用低于50万美元,远远低于谷歌2024年2月发布的Gemini Ultra模型约1.91亿美元的训练成本。
业内专家对阿里巴巴新模型的表现给予高度评价。英国初创公司Stability AI的联合创始人Emad Mostaque表示,该模型的性能超过了去年几乎所有模型。人工智能评测机构Artificial Analysis也指出,Qwen3-Next-80B-A3B在性能上超越了DeepSeek R1和阿里巴巴支持的初创公司Moonshot AI的Kimi-K2等最新模型。
阿里巴巴方面称,这一新一代AI基础模型代表了“高效大型语言模型的未来”,展示了在保持强大性能的同时实现模型紧凑化和成本优化的技术突破,进一步巩固了其在中国人工智能领域的领先地位。
via SCMP Full Text Feed