中国开源权重模型领先,蒸馏只解释一两个月差距
中国模型在下载量和基准上全面领先,但蒸馏只解释一到两个月差距,真正原因是发布节奏和任务聚焦;美国公司正靠中国模型做产品。
原视频在 YouTube 上放不出来,用音频听:
核心论点 · 时间戳为按文稿位置估算
开源权重不等于开源
开源权重模型只公开权重和许可证,开源模型还要公开训练代码和数据。美国真正的开源模型由非营利机构主导,比如 Allen Institute for AI 的 Olmo、OpenAthena 的 Marin、EleutherAI 的 Pythia。Nvidia 的 Nemotron 比多数开源权重模型更开放,发布了大量训练数据,但因为没发布全部数据,仍不算完全开源。这个区分很重要:讨论「开源」时,实际在说的大多是开源权重。
中国模型在智能体能力上跨过门槛
GLM-5.2 和 Kimi K3 在商业可行性上实现了阶跃变化,跨过了类似 Anthropic Claude Code 在 2025 年 12 月跨过的智能体能力门槛。中国开源权重模型大约 18 个月前在这两个关键领域超过美国。Hugging Face 下载量上,中国在 2025 年 7 月领先,主要靠阿里 Qwen。作者维护的 ATOM 项目数据显示,中国下载领先已增长到约 16 亿,总量 32 亿,是美国的两倍。
基准分数差距明显
在 Artificial Analysis Intelligence Index 上,截至 2026 年 9 月 14 日,前三名是中国模型:Z.ai 的 GLM-5.3 和 GLM-5.3-Flash 得分 45 和 42,Moonshot AI 的 Kimi K3 得分 44。美国领先的是 Thinking Machines 的 Inkling 和 Inkling Small,得分都是 26,以及 Nvidia 的 Nemotron 3 Ultra 得分 23。美国顶尖模型发布于 2026 年 6 月和 7 月,更新频率低于中国同行。中国实验室在智能体编程等需求明确的任务上最接近,在物理、生物等开放式科学任务上落后更多。
蒸馏只解释一到两个月差距
蒸馏是中国实验室常用技术,用更强模型的输出训练自己的模型,但作者估计即使完全阻止蒸馏,比如在 Anthropic 和 OpenAI 部署 KYC 工具,美国最强模型到中国开源权重模型的差距也只会增加 1-2 个月。蒸馏在新领域影响最大,并不能轻易造出全面强大的最终模型。中国实验室发布更快、任务分布更窄,这会在公开基准上略微抬高分数,因为所有实验室都在持续进步,发布晚的模型自然分数更高。
美国公司正靠中国模型做产品
Harvey、Cursor、DoorDash 用 Kimi,Airbnb 用 Qwen,Perplexity 用 DeepSeek。大量年轻硅谷创业公司用中国模型来获得低成本、灵活的选择。美国创业公司与中国模型实验室签订企业协议以获得产品使用许可,这是作者职业生涯中未见过的跨境技术合作新形式。OpenRouter 上中国模型份额从约 70% 增长到超过 80%,周处理 token 从 2025 年 9 月的约 1 万亿增长到今天的约 80 万亿。OpenCode 上中国模型推理量占约 95% 或更高。
学术界已被 Qwen 占领
作者扫描了 arXiv 五个最热门 ML 类别(cs.AI、cs.CL、cs.CV、cs.LG、stat.ML)的论文。2023 年 1 月提到任何开源模型的论文占 2%,2026 年 9 月达到 50%。2023 年 4-5 月,约 12000 篇新论文中 2600 篇提到至少一个开源模型家族,5.5% 提到 Llama,1% 提到中国模型。2024 年秋 Llama 巅峰期,23% 提到 Llama,7.5% 提到 Qwen。今天 Llama 仍被约 21% 论文提到,Qwen 升至 30%。任何中国开源权重模型被超过 40% 论文提到,美国是 30%。
美国模型同等能力下采用率更高
研究显示,美国模型在能力与规模相当的情况下,采用率不成比例地高。OpenAI 自 ChatGPT 后首批开源权重模型 gpt-oss 成为史上采用最广的开源权重模型之一。Google 的 Gemma 4 是少数采用量接近 Qwen 最受欢迎小模型的模型。Nvidia 的 Nemotron 尽管在同等规模下能力更强,采用量却一般。这说明美国模型有品牌和生态优势,但不足以扭转整体趋势。
开源模型风险需要生态级准备
开源权重模型的结构性挑战是几乎没有有效方法阻止开源软件片段落入坏人手中。如果因为风险而限制中国最强开源权重模型的访问,受挫的将是美国企业。HuggingFace 曾用中国开源权重模型来理解网络攻击,因为闭源模型拒绝回答请求。管理开源权重模型风险往往归结为生态准备。开源模型正在成为 AI 扩散的必要工具,继续投资美国开源模型是领先这些风险的最佳路径。
原话 · 已逐字校验
Since about April 2025, Chinese AI companies have been the clear leader in open-weight models.
大约从 2025 年 4 月起,中国 AI 公司一直是开源权重模型的明确领导者。
I estimate that if distillation was fully prevented, e.g. with know-your-customer (KYC) tools at Anthropic and OpenAI, the gap from the strongest American models to Chinese open-weight models would only increase by 1-2 months.
我估计,如果完全阻止蒸馏,例如在 Anthropic 和 OpenAI 部署 KYC 工具,美国最强模型到中国开源权重模型的差距也只会增加 1-2 个月。
There is a growing trend of American startups and companies entering enterprise agreements with Chinese model labs in order to get permission to use their models in their products – a new form of cross-border technology collaboration I have not witnessed in my career.
美国创业公司和公司正越来越多地与中国模型实验室签订企业协议,以获得在产品中使用其模型的许可——这是我职业生涯中未见过的跨境技术合作新形式。
To a first order approximation, most of academic research is conducted on Alibaba’s Qwen family of models.
粗略地说,大多数学术研究都是在阿里巴巴的 Qwen 系列模型上进行的。
In our research , we find that American models of comparable capabilities-to-size regions to their Chinese counterparts get adopted at disproportionate rates.
在我们的研究中,我们发现能力与规模相当美国模型相比中国同行,采用率不成比例地高。
If an attempt was made to restrict access to the strongest open-weight models from China because they amplify risks, the parties who would be set back are American businesses.
如果因为中国最强开源权重模型放大风险而试图限制其访问,受挫的将是美国企业。
Open models are going to be the substrate for everyone else in the world outside of the few true frontier AI labs, to harness an acceleration in software engineering and other computational practices.
开源模型将成为世界上除少数真正前沿 AI 实验室之外的所有人的基底,用来加速软件工程和其他计算实践。
数字与实体
| GLM-5.3 在 AAII 得分 | 45 | 0:00 |
| Kimi K3 在 AAII 得分 | 44 | 0:00 |
| Thinking Machines Inkling 在 AAII 得分 | 26 | 0:00 |
| Nvidia Nemotron 3 Ultra 在 AAII 得分 | 23 | 0:00 |
| OpenRouter 上中国模型份额 | 从约 70% 增长到超过 80% | 0:00 |
| arXiv 论文提到开源模型比例 | 2023 年 1 月 2%,2026 年 9 月 50% | 0:00 |
| arXiv 论文提到 Qwen 比例 | 30% | 0:00 |
| arXiv 论文提到任何中国开源权重模型比例 | 超过 40%(美国 30%) | 0:00 |
术语
- open-weight开源权重
- 模型权重公开可下载,但训练代码和数据不一定公开。
- distillation蒸馏
- 用更强模型的输出训练另一个模型,以较低成本获得接近的能力。
- ATOM ProjectATOM 项目
- 作者发起的 American Truly Open Models 项目,追踪美国开源模型数据。
- AAIIArtificial Analysis 智能指数
- 一个流行的模型能力基准,综合多项任务评分。
- KYC了解你的客户
- 通过身份验证限制 API 访问,防止模型被用于蒸馏等用途。
收听指南
关注中美 AI 竞争、开源模型生态的创业者、投资人和政策研究者,想快速掌握 2026 年开源模型格局的人。