AREX Feed Article
Hugging Face Hub 模型数突破 300 万,不到两年新增 200 万
8 月 18 日 11:17(UTC,北京时间 19:17),Hugging Face 官方 X 账号 @huggingface 发推宣布,其 Hub 平台上的模型数量突破 300 万个。推文写道:"We've just surpassed 3 million models on the Hub",并称社区正加速迈向"开放、分布式的未来,让开放 AI 无处不在、人人可用"(an open, distributed future where open AI is everywhere, for everyone),同时附带一段短视频。
8 月 18 日,Hub 的实时计数显示 3,001,548 个模型,与官宣相互印证。这是公开口径下的第三个百万:2024 年 9 月突破 100 万,2025 年 10 月超过 200 万,今天站上 300 万。
官宣之外,平台实时计数已是 3,001,548
本身很简短:一句话宣布数字,一句话描述愿景,再配一段视频。官方没有给出突破 300 万的具体时点,也没有模型类型、许可证或新增速度等任何拆分数据。
数字可以独立核对。8 月 18 日当天,huggingface.co/models 页面顶部显示模型总数 3,001,548,与"刚突破 300 万"的表述吻合。
Hugging Face 联合创始人兼 CEO Clement Delangue 在 11:59 UTC(官宣后约 40 分钟),没有附加评论。
从 100 万到 300 万,用了不到两年
此前公开的里程碑有两个。2024 年 9 月 26 日, Hugging Face 首次突破 100 万个模型条目;当时 Delangue 在 X 上说,"现在每 10 秒就有一个新的仓库(模型、数据集或 Space)被创建",并断言"最终模型会像代码仓库一样多"。
2025 年 10 月 27 日,Hugging Face 官方在发布 huggingface_hub v1.0 时披露,Hub 已托管 200 多万个公开模型、50 多万个公开数据集和 100 多万个公开 Spaces,月下载量 1.135 亿次、累计下载 16 亿次(均为 2025 年 10 月口径),并被 20 多万家公司使用。
按这两个日期推算,从 100 万到 200 万用了约 13 个月,从 200 万到 300 万用了不到 10 个月,每个百万的间隔在缩短。
"一个模型统治一切"是谬误
Ars Technica 2024 年 9 月的报道给出过解释:模型数量激增,源于平台的协作属性,以及"对现有模型做微调"的普遍做法——开发者把已有模型拿去做特定任务的小规模再训练,再把自己的结果传回平台。报道举例说,Hub 上仅 Meta 开放权重 Llama 模型的微调变体就有大量版本。
Delangue 在同一时期把这件事讲得更直接。他在 X 上写道:"与'一个模型统治一切'的谬误相反,针对你的用例、你的领域、你的语言、你的硬件量身定制的小型专用模型更好。"他还提到,Hub 上几乎同样多的模型只对单一组织私有,"供公司私下构建 AI"。
微调生态由此制造了大量"专有小模型",公开模型数正是这样从 100 万滚到 300 万。
CEO 转发、投资人跟评,也有人提醒别只看数量
社区反应在官宣后一小时内陆续出现。投资人 Matt Hartman(X 简介自称早期技术团队投资人,简介中列有 @huggingface)在中写道:".@Huggingface just surpassed $3m models on the hub!"(原帖即如此书写)。
Hugging Face 机器学习工程师 Suvaditya Mukherjee(X 简介标注"ml for cv/3d @huggingface")称:"onwards to the next 3 million, and more!"(向着下一个 300 万,以及更多)。
在,AI 内容作者 Mayank Vora 的判断更具体:"The Hub stopped being a repo years ago it's now the default distribution layer for agents"(Hub 早已不只是仓库,而是 agent 的默认分发层)。他称 300 万模型为"真正的拐点"(the real inflection),并说每个新的本地或多模态发布都先在这里沉淀。
截至北京时间 8 月 18 日 20 时许,官宣推文在 X 上获赞 108 次、被转发 18 次、浏览约 7,300 次,热度不算高。但引用转发里出现了不同的声音。
自称 AI 开发者的 Fajar M Reza ,300 万"是生态规模的信号,不是模型质量的证明"("a signal about ecosystem scale, not model quality");这个里程碑本身,说明不了其中有多少条目是独立、有维护、有许可证、能用于生产的。
3,001,548 只是公开模型的数量
300 万这个数字还有一个口径边界:它统计的是公开模型。Hugging Face 官方博客在 2025 年 10 月曾给出另一个参照——"如果计入私有仓库,规模大约翻倍"。按这个口径,Hub 上模型的实际总规模可能明显高于公开计数,而 300 万只是可见的那部分。
官方推文没有给出突破的具体时点,也没有模型类型、许可证或活跃度的拆分;Fajar 提出的质量问题,公告同样没有涉及。推文里唯一带时间性的表述,是那句"社区正在加速"。下一个百万何时到来,官方没有预告。