Alibaba升级Qwen3模型,超越OpenAI与DeepSeek在数学与编码领域 | 阿里巴巴升级Qwen3模型,超越OpenAI与DeepSeek在数学与编码方面

阿里巴巴集团推出了第三代Qwen3系列大型语言模型(LLMs)的升级版本,特别是新型号Qwen3-235B-A22B-Instruct-2507-FP8,在数学和编码能力方面超过了竞争对手OpenAI和DeepSeek的产品。这款开源模型在指令执行、逻辑推理、文本理解、数学、科学、编码和工具使用等多个方面取得了显著提升,表现优于一些竞品。例如,在2025年美国数学邀请赛中,新模型得分为70.3分,而DeepSeek的最新版本得分为46.6分,OpenAI的GPT-4得分为26.7分。在编码能力方面,新模型在MultiPL-E基准测试中获得87.9分,也优于DeepSeek和OpenAI的模型。

此次升级基于Qwen3-235B-A22B-FP8,但只支持非思考模式,即模型输出不经过明确推理步骤,内容长度提升至256,000个tokens,能处理更长的对话文本。此外,阿里巴巴还宣布,将在中国的个人电脑中,将拥有30亿参数的Qwen模型集成到惠普的智能助手“Xiaowei Hui”中,增强其撰写文档和会议总结等功能。此次发布显示阿里巴巴在AI模型能力和应用场景方面取得了重要突破。

via SCMP Full Text Feed
 
 
Back to Top