A hand connecting a cable to a server rack with
人工智能

阿里巴巴:Qwen开放模型六个月下载超30亿次

该声明远超Hugging Face为谷歌和Meta引用的2026年下载量,但这种计算并不具有可比性。

作者:Elliot Marsh阅读 4 分钟

阿里巴巴集团表示,其Qwen开放权重AI模型在过去六个月内全球下载量超过30亿次,称其为全球下载量最高的AI模型生态系统。这个数字远高于Hugging Face为谷歌和Meta引用的2026年下载量,但该数据包没有提供关于“下载”包含内容的共享方法。

阿里巴巴在Qwen的开放权重推广上标记了30亿次下载。

阿里巴巴对其开放权重战略设定了明确的采用数字。在8月15日的电子邮件声明中,该公司表示,其开放权重模型“在过去六个月中累计超过30亿次全球下载”,并且这一数字“超越了Meta Platforms Inc.、Alphabet Inc.和国内同行,成为全球第一的人工智能模型。”

从机械上讲,“开放权重”分发是一场体量游戏。当权重可用时,开发者可以在本地运行模型,将其微调为特定任务的变体,在托管服务之间镜像,并将其打包成下游工具。每一个步骤都可以产生比封闭模型更多的下载事件。API模型在使用被测量之前,就已经能够做到这一点。

阿里巴巴还将下载声明与生态系统规模联系在一起。它表示,Qwen“开源了超过460个模型”,并且该生态系统“已经孕育了超过30万个”衍生品“”,意味着在基础版本之上构建的经过微调或修改的变体。这个组合很重要,因为它是飞轮:更多的基础检查点创造更多的衍生品,而衍生品创造更多的分发表面,在这些表面上可以再次提取相同的基础权重。

数据包中的比较点来自Hugging Face,这是一家模型托管平台,同时发布定期的市场快照。在其2026年8月14日的“开放模型状态”报告中,Hugging Face列出了谷歌(Alphabet的一部分)在2026年的下载量为4.18亿次,Meta在2026年的下载量为2.27亿次。乍一看,阿里巴巴在六个月内的“超过30亿”将比这些数字大一个数量级。

关键在于,该数据包并没有证明这些数字在测量同一件事。阿里巴巴的数字是其开放权重模型的总和,但声明并没有定义“下载”是唯一用户还是总下载量,是否包括镜像和分叉,或者计数是否是按模型在Qwen家族中汇总的。Hugging Face的数字被呈现为“2026年的下载量”,但数据包并没有具体说明这是否仅限于Hugging Face托管的下载,还是更广泛的估计,或者它如何处理镜像工件。

如何阅读Hugging Face基准——以及接下来要跟踪什么

将“按下载量排名第一”的框架视为情感输入,而不是一个干净的排行榜。没有共享定义,下载量可能会因完全正常的开源行为而被夸大:自动化CI拉取、跨地区的重复下载、多个托管镜像,以及重新打包相同权重的衍生模型。这些都不会使足迹变得虚假,但确实使跨提供商的比较变得脆弱。

对于试图将其映射到“开发者心智份额”叙事的交易者来说,有两个可比性差距最为重要。首先是方法论:阿里巴巴的声明没有说明它将什么计为下载,数据包也没有提供独立验证。第二是时间基准:阿里巴巴的时间窗口是“过去六个月”,而Hugging Face的数字被描述为“在2026年”,即使两者都准确,这也可能不是可比的。

下一个信号是直接的,主要是文档性的。阿里巴巴的任何后续披露,如果明确了计数规则,将会收紧这一声明,特别是3B数字是否是唯一的还是总的,是否包括镜像,以及是否是所有Qwen版本的汇总。下一个Hugging Face的“开放模型状态”更新也很重要,特别是Qwen是否与Google和Meta的可比会计一起出现,而不是作为一个平台外的声明。

最后,关注阿里巴巴是否更新了它在记录上提到的两个生态系统计数器:“超过460个”开源模型和“超过300,000个”衍生品。如果这些数字在后续声明中持续上升,这将支持Qwen的分发是由持续的基础发布和下游重混驱动,而不是一次性的爆发。

我的看法:下载量是叙事催化剂,而不是干净的记分板

我将阿里巴巴的“六个月内3B”数字视为分发意图的可信标志,而不是谁“赢得”开放模型的明确排名。开放权重生态系统是为了被复制、镜像和重新编译成衍生品而构建的,而阿里巴巴明确声称有460多个基础发布,提供超过300,000个变体。即使基础使用更加集中,该机器也能产生巨大的下载量。

重要的门槛是阿里巴巴(或Hugging Face)是否发布了可比的会计,让市场能够在相同基础上比较Qwen的足迹与Google和Meta。如果这种可比性出现,而Qwen仍然以较大幅度领先,那么这种设置开始看起来是结构性的,而不是由叙事驱动的,因为这将意味着在一个可以拉动工具、计算需求和心智份额的规模上,开发者分发是持续的。

来源