DeepSeek、阿里巴巴助力中国缩小与美国在领先AI模型上的差距:斯坦福报告
斯坦福大学的研究报告显示,中国在人工智能(AI)模型领域的研发能力正迅速赶超美国。在主要AI评估基准测试中,中国模型的性能与美国模型的差距已从2023年的两位数大幅缩小至去年的几乎持平。例如,在衡量大规模多任务语言理解(MMLU)方面,中国和美国模型之间的性能差距从两年前的17.5个百分点缩小到2024年底的0.3个百分点,凸显了中国科技公司在技术前沿的持续努力。
包括阿里巴巴、字节跳动、腾讯以及DeepSeek和智谱AI等AI初创公司在内的中国大型科技公司,在去年发布的知名AI模型数量方面位居全球前15名。 其中包括阿里巴巴的Qwen系列,以及DeepSeek的V3基础模型和R1推理模型。 斯坦福报告特别指出,DeepSeek于2024年12月发布的V3模型引起了广泛关注,因为它在需要远少于许多领先AI模型的计算资源的情况下,实现了极高的性能。
via SCMP Full Text Feed
斯坦福大学的研究报告显示,中国在人工智能(AI)模型领域的研发能力正迅速赶超美国。在主要AI评估基准测试中,中国模型的性能与美国模型的差距已从2023年的两位数大幅缩小至去年的几乎持平。例如,在衡量大规模多任务语言理解(MMLU)方面,中国和美国模型之间的性能差距从两年前的17.5个百分点缩小到2024年底的0.3个百分点,凸显了中国科技公司在技术前沿的持续努力。
包括阿里巴巴、字节跳动、腾讯以及DeepSeek和智谱AI等AI初创公司在内的中国大型科技公司,在去年发布的知名AI模型数量方面位居全球前15名。 其中包括阿里巴巴的Qwen系列,以及DeepSeek的V3基础模型和R1推理模型。 斯坦福报告特别指出,DeepSeek于2024年12月发布的V3模型引起了广泛关注,因为它在需要远少于许多领先AI模型的计算资源的情况下,实现了极高的性能。
via SCMP Full Text Feed