2026 年世界开源 AI 大模型,各种统计报告!
时间:2026-9-12 03:09 作者:独元殇 分类: 开发相关
永远承诺:本网站,所有字均为人工手敲!无一字为 AI 生成(除非标注)
截止 2026-9 ,正好,最近我也要盘点一下大模型。
而 huggingface 最近也出了一份报告。
我本着学习和记笔记的态度,把这个报告的笔记给写出来。
报告的原址: https://huggingface.co/blog/state-of-open-models-summer-2026
huggingface 上面的模型,都是开源模型,看看这个图,很夸张啊:
各种数据集数量
这是Hugging Face 上公开的数据集数量,现在 26 年 9 月刚刚超过了 100万个!去年 9 月才 50万。
说明:红色是 NLP ,蓝色是计算机视觉,绿色是 Audio,比如语音识别、声音分类。橙红色是 Multimodal,多模态,例如图片加文字。黄色是 Reinforcement Learning,强化学习。紫色是 Tabular,表格数据。
然后中国的模型,很厉害!
上限
我看到这图,就觉得,开源模型的上限,可以直接说是由中国决定。
右上角的 Kimi-K3 真的太耀眼了哈哈。
这么多的中国模型。横轴是日期,纵轴是参数量。美国的开源 AI 模型参数,始终没有突破 1TB 。其实也是迫不得已呀,不开源,没法占领市场,经营各种生态,闭源模型那边始终美国主导。
然后是中国模型的组成
这是中国的主要的 AI 大模型实验室(或者说公司)。
横轴统计范围,是2026 年 1 月 1 日到 7 月 31 日。就是今年发布了多少模型。Kimi 发布了 4 个,而腾讯发布了 59 个(好心疼腾讯,入局完了,疯狂补课哈哈)。而颜色就是 小模型和旗舰模型。蓝色的都是小模型,橙色的是旗舰模型
这个图,设计的很好。对于各个公司的发布状态,一目了然。
最厉害的就是 Kimi ,模型少,但是各个旗舰。而阿里,则都发布。(当然,这个是开源的,不包括闭源的,别小看了字节)
(对了,百度去哪里了)
那大洋彼岸的美利坚呢?
美国和中国的仓库数量
横轴是时间,纵轴是中美各个公司的在 HF 的模型仓库发布数量。
黄仁勋的英伟达,发布了 200 个,而它的对手 AMD 发布了 235 个。当然,不能靠这个说 AI 的厉害水平,而是能看出来游戏规则不一样了。他们两个硬件公司,之所以发布这么多,是为了给开源模型做适配,而不是从头训练。为什么游戏规则不一样了?因为美国硬件强呀,你负责造模型,我负责造给模型运行的机器。。。 这是两个赛场,你的赛场你赢,我的赛场我赢。
不过也能看出,美国的 Google、Microsoft、Meta 在开源 AI 方面还是出力很多的。
当然,别忘了中国开源模型也正在针对中国国内芯片进行优化。只不过,美国芯片还是主流。
然后是有趣的,关注度和采用度。
关注度和采用度
这张图,横轴是下载量(注意,是对数坐标哦,越往右实际用量会越巨大),纵轴是互联网上对它关注度。
很奇怪,关注度越高应该被人下载的越多呀!
然而实际上,关注度越高的,反而下载量那么少。。。 哈哈。 Kimi-K3 的热度那么高,但是谁有本身能本地部署它呢?
倒是下载量最好的,好多冷门的小而好用的模型。
怎么理解呢?就跟法拉利、迈巴赫一样,大家天天装,天天讨论,但是开车还是五菱宏光或各种普通车,甚至是不知名的性价比高的车。就这个意思,大家懂。
那么具体下载了什么,可以看看这个图。
纵轴是每个公司(这里只列出了主要的几个公司),横轴是这个公司的发布的全部产品。
比如 月之暗面 moomshotai ,88% 的产品,是在 70B 以上的大参数模型上。
一眼看去,其实会发现,下载量基本上集中在小参数模型上。
当然,这个报告还有很多有趣但是很有价值的图片。大家可以去原文地址读读。很有价值。