检测到您的浏览器版本过低,可能导致某些功能无法正常使用,建议升级您的浏览器,或使用推荐浏览器 Google Chrome EdgeFirefox X

首页科技前沿与新兴产业新一代信息技术人工智能

Hugging Face发布半年度开源模型现状报告(二)

供稿人:罗雅莹供稿时间:2026-08-26 15:02:25关键词:开源模型,现状,HuggingFace

5.不同厂商内部模型产品下载量分化

MiniMax在Hugging Face上的2026年下载量几乎全部来自700亿参数以上模型,月之暗面这一比例达到88%,DeepSeek和智谱分别为55%和39%。美国企业则主要依靠中小模型获得下载量,谷歌、微软和IBM Granite的700亿参数以上模型下载占比接近于零,英伟达和Meta分别约为14%和9%(图6)。


图6 2026年Hugging Face上各规格模型2026年下载量

6.模型的采用率和关注度出现分化

图7展示了点赞量前25和下载量前25的模型几乎分为两个区域,2026年1月-8月,Hugging Face平台模型点赞量和下载量最高的前25个模型中只有一个模型重叠。报告指出,点赞和下载是对模型的不同反映,对应模型的不同的阶段,Kimi-K3、DeepSeek-R1等前沿模型发布后容易迅速获得大量社区关注获得高点赞量,而更多稳定的成熟模型及小模型被持续调用和整合,拥有更高的实际下载量。点赞量和下载量不能相互替代,模型的社区热度和使用情况出现分化。


图7 点赞量和下载量top25模型对比

7.中国开放大模型开源许可条款普遍宽松

在178个中国企业发布的200亿以上参数规模的模型中,有59%采用Apache 2.0协议, 22%采用MIT协议,两者合计81%。美国20B以上的模型中,Apache协议占20%,MIT协议占9%,41%采用其他协议,30%未明确声明许可(图8)。相比之下,中国企业发布的大模型普遍采用更宽松的许可协议,允许进行模型修改、分发和商业使用。对开放模型企业而言,商业收益更多来自API调用、云服务、企业部署等。与此同时,开放模型和商业收益之间的新型许可模式也在建立,随着模型规模扩大和训练成本增加,Kimi-K3、Qwen 3.8等模型已加入非商业使用限制等要求。


图8  中美开放模型许可协议对比

8. 模型部署工具增速加快

围绕模型部署的开发工具在快速增长(图9)。GGUF和llama.cpp等量化技术可使万亿参数模型在消费级设备上运行。自2026年2月发布ggml和llama.cpp以来,更多开发者和社区成员取代了批量制作模型量化版本的专业账号,模型量化从一项专门化工作逐渐变成开放模型社区的标准操作。


图9  GGUF版本仓库数量

总结

Hugging Face2026开源模型报告可看出,最前沿的超大模型继续抬高能力上限,并获得大量社区关注,但真正形成大规模下载的往往是中小模型和成熟完整的模型家族。与此同时,Apache、MIT等宽松许可降低二次开发限制,Qwen模型开源生态繁荣,GGUF、llama.cpp等工具进一步降低实际部署门槛,开放模型的竞争不再只停留在开放权重,而是逐渐形成一条从基础模型发布、社区关注、二次开发、量化适配、实际部署的完整链条。

参考资料:

[1] Hugging Face. State of Open Models: Summer 2026 Observations[EB/OL]. (2026-08-14)[2026-08-27]. https://huggingface.co/blog/state-of-open-models-summer-2026

[2] Hugging Face. State of Open Source on Hugging Face: Spring 2026[EB/OL]. (2026-03-17)[2026-08-27].https://huggingface.co/blog/huggingface/state-of-os-hf-spring-2026