Alibaba’s healthcare AI model on par with senior physicians in medical exams | 阿里巴巴医疗AI模型在医学考试中与资深医生水平相当
阿里巴巴集团宣布,其基于通义千问(Qwen)系列打造的医疗人工智能模型已达到资深医生的水平,并通过了中国医师资格考试,在包括内科、外科、妇产科、儿科等12个常见医学学科中达到了“副主任医师”的标准。该模型现已集成到阿里巴巴旗下的AI助手Quark(夸克)应用中。
该医疗AI模型由通义千问2.5-32B基础模型驱动,并经过大量高质量数据和多阶段训练的支持。在Quark提供的基准测试数据中,该模型在测试准确率上优于DeepSeek的R1和V3,以及OpenAI的GPT-4o。它在“副主任医师”级别的准确率达到74.8%,在顶级的“主任医师”级别也达到了56.4%的准确率。
据阿里巴巴称,该医疗模型已完全集成到Quark中,当用户提出健康相关问题时,Quark会自动部署该模型。通过与医院和医疗机构的合作,该模型在准确性方面得到了进一步的提升,并且正被这些机构应用到他们自己的应用中。
via SCMP Full Text Feed
阿里巴巴集团宣布,其基于通义千问(Qwen)系列打造的医疗人工智能模型已达到资深医生的水平,并通过了中国医师资格考试,在包括内科、外科、妇产科、儿科等12个常见医学学科中达到了“副主任医师”的标准。该模型现已集成到阿里巴巴旗下的AI助手Quark(夸克)应用中。
该医疗AI模型由通义千问2.5-32B基础模型驱动,并经过大量高质量数据和多阶段训练的支持。在Quark提供的基准测试数据中,该模型在测试准确率上优于DeepSeek的R1和V3,以及OpenAI的GPT-4o。它在“副主任医师”级别的准确率达到74.8%,在顶级的“主任医师”级别也达到了56.4%的准确率。
据阿里巴巴称,该医疗模型已完全集成到Quark中,当用户提出健康相关问题时,Quark会自动部署该模型。通过与医院和医疗机构的合作,该模型在准确性方面得到了进一步的提升,并且正被这些机构应用到他们自己的应用中。
via SCMP Full Text Feed