过去7个月,美国开源模型向中国“抄作业”

腾讯科技
报告显示,今年前7个月中国开源模型参数规模持续领先,并成为美国千亿级模型的重要底座,多数美国模型基于此进行微调或适配。当前竞争已从拼参数转向实用生态与本地部署(小模型下载量更高)。中国已占据生态先机,迫使美国巨头调整策略重新入场。

近期,Hugging Face发布了最新报告《开源模型现状:2026年夏季观察报告》。

报告中指出,2026年以来,中国实验室在前沿开放模型的参数规模上持续领先,美国的竞争重心则逐渐从Meta、谷歌等模型实验室转向英伟达、AMD等芯片和基础设施公司。

更值得注意的是,中国模型正在成为美国千亿级参数大模型的重要底座。报告中称,今年前七个月,美国发布的1000亿参数以上开源模型中,多数基于中国模型进行微调、量化、格式转换或硬件适配。

与此同时,模型数量虽然持续快速增长,但真正被开发者长期使用的模型仍然集中在少数仓库,模型热度与实际采用之间也存在明显差距。

今年前七个月,Hugging Face上的公共模型仓库从243万个增至296万个,数据集突破100万个,Spaces(在线运行AI应用的平台)增至144万个。但85.6%的模型终身下载量不足200次,仅1.5%的模型仓库贡献了99.2%的下载量。

Hugging Face上数据集的数量持续增长,2026年已突破100万个

真正进入开发流程的模型,依然只是其中很小的一部分。

前沿模型不断冲向万亿参数,实际下载却仍然集中在小模型:在参数规模已知的模型中,1B(10亿)参数以下模型占历史下载量的83%,超过1000亿参数的模型仅占1%。

01 中国模型冲到前沿

今年前七个月,中国开源模型的月度参数规模上限在7540亿至2.78万亿之间。美国有五个月的原创模型上限低于1300亿参数,只有英伟达5月和6月发布的Nemotron 3 Ultra(5610亿参数)以及Thinking Machines Lab的Inkling(9520亿参数)例外。

2026年前七个月,中国实验室的月度最大开源模型规模持续领先美国

此外,中国实验室的模型规模策略也出现分化。

月之暗面、MiniMax、小米和智谱新模型主要集中在更大规模上。而阿里巴巴的Qwen覆盖不同参数规模,形成了另一种路线。

每家AI实验室都有不同的模型规模策略

报告中解释称,这种变化与模型开发方式的变化有关。大模型本身已经很难成为差异化优势,而量化工具的发展又让大型模型能够更快进入本地设备。实验室没有必要一定先发布小模型,再逐步向更大规模推进。

与此同时,美国千亿级开放模型中,越来越多并非从零开始。在这一规模上,美国原创模型数量有限。

报告列出的主要模型包括Thinking Machines Lab的Inkling、英伟达Nemotron 3系列和Arcee AI的Trinity-Large。AMD虽然上传了大量超大模型转换版本,但同期没有发布这一规模的原创基础模型。

这让美国公司的角色出现了变化。2026年发布新模型仓库最多的两家公司是英伟达和AMD,各自超过200个,远高于其他机构。

Hugging Face认为,英伟达和AMD发布的模型大量围绕自身芯片进行优化,模型本身也在成为硬件性能的展示。

AMD与英伟达成为美国今年开源模型发布数量最多的两家硬件厂商

相比之下,谷歌和Meta过去几年在开源模型领域的领先位置有所下降。开源模型的主要推动者,正在从传统模型实验室向芯片和基础设施公司扩展。

02 大模型很热,小模型更实用

模型参数不断增加,但下载量并没有跟着转向大模型。

Hugging Face统计显示,2026年下载量最高的25个模型与点赞数最高的25个模型,只有一个重合。2026年发布的模型没有一个进入下载量前25名,其中13个模型来自2022年。

通用文本嵌入模型all-MiniLM-L6-v2在今年前七个月被下载15.5亿次,却只有5156个赞。Kimi-K3则大约每获得一个赞,对应60次下载。

Hugging Face发现,点赞更多集中在新模型发布后的关注期,下载则更多来自已经进入开发流程的模型。模型发布时获得多少关注,并不能直接反映后续使用规模。

这种差异也体现在模型规模上。

在参数规模已知的模型中,1B以下模型占历史下载量的83%,超过1000亿参数的模型仅占1%。2026年的情况同样如此,超过700亿参数的模型下载量只占3%。

参数较小模型依然是下载主力

中国前沿实验室的下载结构与美国机构明显不同。Qwen凭借覆盖不同规模的模型家族达到20.45亿次下载。

而MiniMax今年的下载量几乎全部来自700亿参数以上模型,月之暗月为88%,DeepSeek为55%,智谱为39%。谷歌、微软和IBM Granite在这一规模上的下载量几乎为零,英伟达和Meta分别为14%和9%。

阿里Qwen成为下载量最多的开源模型系列

前沿模型不断变大,但如何让这些模型真正运行起来,已经成为另一个问题。

2026年7月的Hugging Face快照中,已经出现DeepSeek-V4-Flash约2840亿参数和Kimi-K3约2.8万亿参数的GGUF构建。

GGUF是一种适合本地运行的模型文件格式。经过量化后,模型可以减少运行所需的内存,再配合llama.cpp等工具部署到本地设备。

这使得超大模型不必完全依赖云端。过去,本地运行大模型主要集中在几十亿参数规模。如今,开发者可以通过多台消费级设备运行更大的混合专家模型。

围绕模型运行的工具也在快速增长。过去七个月,Hugging Face模型仓库增长21.5%,声明使用gguf库的仓库却增长464%,Apple MLX增长148%,LeRobot增长194%。

03 竞争已经延伸到生态

模型开源之后,竞争并没有结束。对于发布者来说,更重要的问题是,开发者是否愿意修改、部署,并在模型基础上继续开发。

许可证是其中一个重要因素。

今年超过200亿参数的178个中国模型中,59%采用Apache 2.0许可证,22%采用MIT许可证,两种许可证都允许开发者修改、再发布和商业使用,没有设置非商业限制。

DeepSeek和智谱甚至用MIT许可证开放了7000亿至1.65万亿参数的模型。

相比之下,美国同规模模型的授权方式更加分散,29%采用Apache或MIT许可证,41%使用自定义条款,还有30%没有明确声明许可证。

这意味着,大型开放模型本身并不是主要的直接收入来源。模型免费开源后,商业价值更多需要通过API、云服务、硬件和开发者生态实现。

生态规模因此成为另一个竞争指标。Hugging Face数据显示,基于Qwen的衍生模型已经超过15万个。2026年前七个月,Qwen衍生模型每天新增约180至210个仓库。

这种生态效应同样存在于本地运行领域。目前,十大模型家族中,官方提供GGUF版本的并不多,但社区已经围绕这些模型制作了大量本地运行版本。以Qwen为例,每月GGUF下载量约3960万次,接近Gemma的两倍,是Llama的五倍多。

另一个正在扩大的变量是智能体。Hugging Face今年7月首次披露智能体访问数据:Claude Code占44.4%,低于4月的67.8%。Codex则从10.4%升至20.8%。与此同时,近四分之一流量来自尚未识别的工具,4月至7月还出现了十多个新的客户端标识符。

这表明智能体正在成为Hugging Face的新一类用户。它们已经可以通过工具搜索模型、下载数据集、运行任务和调用应用,模型的使用入口正在从人工操作扩展到AI智能体。

04 Meta和英伟达重新入场

中国实验室在开源模型领域的领先,也迫使美国公司重新调整策略。

8月10日,Meta发布Muse Glimmer,采用Apache 2.0许可证开放权重。一天后,英伟达推出Nemotron 3.5 Lightning。两款模型都约300亿参数,重点都放在本地部署和智能体工作负载上。

Meta的Muse Glimmer针对本地智能体、编程和函数调用设计,量化版本可以压缩到20GB以下。

英伟达的Nemotron 3.5 Lightning则采用混合专家架构,并配套推出开源路由库NeMo Switchyard,让不同任务可以调用不同模型。英伟达希望企业使用多个模型,再根据成本、速度和能力进行调度。

Meta的回归尤其值得关注。过去两年,中国公司在开源模型上的发布速度明显更快,Meta的Llama也已经不再是开发者唯一的主流选择。

Muse Glimmer的意义,不只是多了一个模型,而是Meta重新把开发者和本地部署放回开源战略中心。此前的资料也显示,中国开源模型在OpenRouter的token消耗中已经占据明显优势。

这场竞争最终会落到一个更具体的问题上:谁能让开发者更方便地下载、修改、部署和长期使用模型。

从目前的情况看,中国实验室已经在前沿模型和生态建设上取得先手,美国公司正在重新进入战场。模型参数规模仍然重要,但决定长期位置的,越来越是模型能否进入真实工作流。

这会让开源模型市场的变化速度进一步加快。

本文来源:腾讯科技

风险提示及免责条款
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
相关文章