中国AI实验室将开源权重转化为四种不同策略

专栏概览
7月25日,英伟达CEO黄仁勋在X平台(原推特)上发布了他的第一条帖子,署名支持了一件不寻常的事:一封联合声明。该信件由Meta、微软、Hugging Face等公司共同签署,主张开源权重模型应与封闭的前沿系统并列,成为AI景观中永久的一部分,而非次要的追赶者层级。这更像是一则原则性声明,而非任何产品的发布公告。但这一时机赋予了它独特的共鸣,因为在信件发布前后的几天里,四家中国AI实验室推出了四项发布,合在一起使这封信的抽象观点变得具体——同时也使其复杂化。月之暗面(Moonshot AI)、DeepSeek、阿里巴巴和MiniMax目前都在交付开源权重,但它们这样做并非出于相同的原因或采用相同的方式。“开源权重”并非这些公司收敛到的单一策略;它是一个标签,被四家不同的公司填充了四种不同的赌注。
直言不讳的信函
黄仁勋的信件之所以引人注目,并非因为论点本身——许多研究人员都曾论证过,开源权重能加速下游研究,并为较小的开发者提供公平的机会来构建基于前沿级技术的产品。引人注目的是谁签署了它以及何时签署。一家硬件公司、一个基础模型实验室、一个云平台和一个开源模型托管中心公开同意,开源权重不是权宜之计,而是一个持久的类别,这是一个信号,表明围绕开源模型的商业生态系统——芯片、托管、微调服务、企业部署——已经成熟到值得书面捍卫的地步。正是这个生态系统,使得中国实验室在过去几个月中最活跃,这也使得它们近乎同时发布的消息值得并排阅读,而不是作为孤立的新闻项目。
月之暗面的赌注:更大即是重点
月之暗面在将“开源权重”作为营销和技术主张的含义上最为直白。它在7月19日发布了一个预览版Kimi K3,拥有2.8万亿参数和百万token规模的记忆,随后在7月28日发布了完整版本,号称是迄今为止发布的最大开源权重模型,定位为在能力上与顶级美国封闭系统相媲美。无论“最大”一词在独立复现基准测试后是否经得起推敲,其战略逻辑在其自身条件下是清晰的:月之暗面将原始规模视为一种开源权重的可信度形式。如果你要免费赠送一个模型,那么按照这种说法,就赠送一个足够大的模型,以至于没有人能将开源层级贬低为真实事物的折扣版。这是一个赌注,即规模本身就是头条新闻,而这个头条新闻对月之暗面来说,比更精简、更高效的模型更有价值。
DeepSeek的双轨策略:释放权重,以价格 undercut
DeepSeek正在进行不同的实验,值得注意的是,它有两个组成部分,而不是一个。4月,该公司发布了DeepSeek V4的开源预览版,这是一个拥有万亿参数和百万token上下文的模型——与月之暗面的发布处于相同的规模讨论范围内。但一个月后,DeepSeek做了一件与开源权重毫无关系的事情:它将旗舰V4-Pro API定价的75%折扣永久化,而不是限时促销,实际上使其成为市场上最便宜的前沿级API。将这两项举措结合起来,DeepSeek的战略呈现出双管齐下的特点,而非单一。开源权重服务于希望自托管、微调或直接审计模型的用户群体;激进的API定价服务于那些只想进行推理而无需任何额外开销的更广泛用户群体。DeepSeek并没有在“开放”和“廉价”这两种竞争身份之间做出选择——而是利用它们来触达不同的客户,而这些客户中的任何一个都无法通过另一种方式得到服务。
阿里巴巴的组合方法:一款旗舰,一款专家
阿里巴巴的Qwen团队采取了不同的路线,将开源权重视为需要精心填充的产品组合,而不是单一的旗舰赌注。Qwen3-Coder是一个专为编程任务发布的4800亿参数模型,而Qwen3-Max-Preview是一个万亿参数的通用旗舰模型,两者在大约六周内相继推出,显然不是为了相互竞争——而是为了覆盖不同的任务。这与“发布你拥有的最大的东西”的开源权重策略有着实质性的不同。它读起来更像是一条产品线,而不是单一产品:一个面向最广泛开发者基础的通用模型,以及一个针对特定垂直领域(代码生成和智能体编码工作流)的专家模型,在该领域中,企业对边际质量提升的支付意愿最高。覆盖范围,而非规模,是组织思想的核心。
MiniMax的狭义赌注:自我改进的智能体
MiniMax选择了四家中最狭窄的赛道, arguably(可以说)也是技术上最具体的赛道。M2.7于4月作为开源权重发布,其卖点在于自我进化的智能体架构,而非通用的聊天或推理能力,据报道在SWE-bench Pro上得分为56.22,在Terminal-Bench 2上得分为57.0——这些基准测试衡量的是智能体自主完成实际编码和基于终端任务的能力,而不仅仅是很好地回答问题。当月之暗面在销售规模,阿里巴巴在销售覆盖面时,MiniMax在销售一种能力:一个围绕这样一个理念构建的开源模型,即智能体应通过自身的迭代在任务中变得更好,而不是需要更大的基础模型或更多的微调数据。这是一个赌注,即开源权重模型的下一个竞争轴心根本不是参数量,而是模型作为自主系统核心的功能有多好。
“开源权重”究竟为他们带来了什么
将这四点并列起来,有趣的结论并不是中国AI实验室都决定开源权重是未来——而是他们各自对开源权重用于什么得出了不同的结论。对于月之暗面,开源权重是一个兼作可信度声明的规模声明。对于DeepSeek,它们是双轨分发策略的一半,另一半由价格承担。对于阿里巴巴,它们是建立市场覆盖范围的一种方式,涵盖通用旗舰和编码专家,而不必让两者相互竞争。对于MiniMax,它们是通往更狭窄、更技术性赌注的载体,专注于智能体的自我改进。黄仁勋的信件将“开源权重”视为原则上值得捍卫的类别。这四个发布所显示的是,在该类别内部,实际的战略内容差异巨大——而且,这种多样性比任何单个发布都更能持久地讲述开源模型下一步走向的故事。