OpenAI罕见Open,A社还在硬撑,黄仁勋的开源公开信在力挺谁
2 小时前 / 阅读约9分钟
来源:凤凰网
黄仁勋发公开信力挺开源AI模型,引发AI公司签署热潮。公开信讨论模型开发方法与蒸馏技术,涉及中美AI竞争。OpenAI补签,行业讨论合法蒸馏边界,争夺智能流动规则。

前几天,黄仁勋发出了他的第一条 X ,一封《开放权重与美国 AI 领导力》公开信,力挺开源 AI 模型。

Jensen Huang 用自己的第一条 X 帖分享了这封公开信;图源:Jensen Huang / X。

最初只有 25 家公司和机构签名。几天后,名单扩到了 70 多家,Google、SpaceX、GitHub 都在其中。最后连 OpenAI 都出现了。

主流的 AI 公司里,就剩下一家还没有签署,那就是奥特曼的一生之敌 Anthropic 。

这事不只是开源阵营又赢一局的爽文,公开信这一段才是重点:

不应把正常的模型开发方法与不当挪用混为一谈。使用一个模型的输出训练或改进另一个模型,是广泛使用的技术。

简单来说,开放权重让模型可以被下载和修改。蒸馏则让一个模型从另一个模型的回答里学习。这其实也是对最近美国指责中国模型蒸馏的一个表态,而今天中国官方也对此进行了回应:

美方罔顾有关中国企业人工智能模型与美前沿模型发布时间非常接近、中国部分模型能力已处于领先地位等事实,给中国企业扣上所谓依靠蒸馏、窃取美国知识产权等帽子,还威胁进行打压制裁。这些做法缺乏事实依据,没有法理支撑,在实践上搞双重标准,属于典型的人工智能霸权主义行径。

这个问题不只关乎开源,也关乎下一轮 AI 竞争里更重要的一项权利:谁能向谁学习(蒸馏)。

黄仁勋算的是什么账

A 社没有发官方声明,但曾参与 AlphaGo Zero的技术人员 Julian Schrittwieser 先开麦了。

他转发黄仁勋的帖子,还有点阴阳的意思:老黄既然这么信开源,CUDA 和 GPU 驱动什么时候开源呢?

当然这只是员工个人发言,不代表 Anthropic。但对黄仁勋来说,这确实首先是一笔算力生意。

英伟达从未要求自身开放 CUDA,它通过倡导模型层的开放来做大整体蛋糕。模型层越走向开放和大众化,全社会的算力与部署需求就越庞大,从而直接转化为对 英伟达硬件的巨额采购。

公开信替两种做法争取空间:企业可以把开放模型下载到自己的服务器,也可以让小模型从强模型的回答中学习。后一种训练方法,业内叫蒸馏

问题恰恰出在第二件事上。

今年 2 月,Anthropic 称,有人使用大量账号和代理,规避 Claude 的访问限制,再把收集到的回答用于训练其他系统。A 社把这类行为称为蒸馏攻击。这是 Anthropic 一方的主张,并非司法结论。

到了 4 月,白宫发布的国家安全备忘录将未经授权的大规模提取和绕过访问限制的行为纳入打击范围,但当时并未直接禁止模型蒸馏。

不过,一项酝酿中的法案准备将监管范围进一步扩大:若企业服务条款明令禁止使用其模型输出训练其他模型,任何违反该约定的行为,都可能被直接判定构成蒸馏攻击。

争议就这样从“怎样拿到模型的回答”,走向了“拿到回答以后能做什么”。

如果正常的能力迁移也被笼统视为风险,开放模型会更难追上,企业也会更依赖少数公司的接口。

黄仁勋甚至都直接说了,免费 AI 对硬件、芯片和数据中心都应该是好事。

模型便宜、能下载,企业才更愿意把它装进自己的环境,用在客服、编程和内部问答里。模型跑得越多,推理芯片、服务器和配套软件的需求就越大。

左边按次调用闭源 API,右边把开放权重模型放进自己的环境。自托管仍然需要支付 GPU、存储和运维成本。

英伟达不需要押中唯一赢家。

闭源模型继续冲能力上限,开放模型把能力带进更多企业和设备,只要 AI 的部署继续扩散,底层都需要计算。

而蒸馏正是开放模型常用的追赶办法。Meta 就公开说明,它让小模型学习自家大模型,把能力装进更便宜、更容易运行的模型里。

黄仁勋要保住的,不只是开源这个口号,他需要保护和培育一个模型足够多、部署足够广、算力需求不断增长的市场。

OpenAI 后来为什么也 Open 了

OpenAI 一补签,名字里的Open自然又被网友翻了出来。其实公开信发布当天,Sam Altman 已经表态支持开放模型与闭源模型并行,公司却没有出现在首批名单里。

纽约时报记者 Mike Isaac 记录了 OpenAI 后来出现在签署名单中的页面变化;图源:Mike Isaac / X。

不过没两天,这个页面上就多了 OpenAI 的名字。官方没有解释为什么后来补上签名,但 OpenAI 本来就同时站在开放和封闭两种模式里。

OpenAI 官方 gpt-oss 发布页;图源:OpenAI,页面截图未改动原文。

2025 年,它发布了可以下载、自行部署的 gpt-oss。另一边,最核心的模型仍通过 API 收费。

它的商业协议是这样说的:企业客户原则上拥有调用模型API获得的输出,却不能拿这些模型的输出,开发与 OpenAI 竞争的模型。

说白了,拿到模型的输出,不等于获得了训练任何模型的许可。

OpenAI 也卖过官方蒸馏工具:开发者可以在它的平台内,用强模型的回答训练成本更低的小模型,并为训练付费。

这恰好展示了 OpenAI 理想中的蒸馏:

技术不必禁止,但需要授权;门可以打开,钥匙最好还在平台手里。

设想一家企业付费调用前沿模型,攒下几万条回答,再用这些回答训练一个只服务内部业务的小模型。它已经付过 API 费用,这些回答算不算它的?内部使用可以,对外出售还可以吗?

如果新模型做得越来越像教师模型,又从哪一步开始变成蒸馏攻击?偶尔生成几条训练样本,和用大量账号持续提取一项能力,显然不同。

二者之间却没有公认的衡量标准。

于是同一批输出,可能因为用于内部工具、商业小模型或直接竞争,而落入不同的规则框架。

OpenAI 没有公布一套完整的分级收费方案。但它现有的商业协议和蒸馏工具已经说明,调用模型是一种权利,积累输出再训练另一个模型,可能是另一种。

所以,OpenAI 补签不等于转向完全开放。它既要保护自家的闭源模型,也不愿把合法蒸馏的定义权让给别人。

当整个行业开始讨论谁能使用模型输出、能用到什么程度时,它必须坐在制定规则的牌桌上。

最后争的,不只是蒸馏权

表面看,这些大厂想定义合法蒸馏的边界。实际上它们在争的是:模型能力到底该像商品一样买断带走,还是像水电一样按月续租。

这两种商业模式会改变企业使用 AI 的方式。过去的软件平台锁的是数据。你的通讯录、文件、交易记录,导出来费劲,所以你走不了。而AI 平台未来可能锁住的是能力。

企业在长期使用模型时,会不断投入自己的文档、流程、修改意见和专家反馈。这些信息不仅帮助模型完成一次任务,也在形成企业自己的工作方法。

如果这些经验只能留在平台里,不能被企业自己的模型继承,那么企业付费积累下来的不是资产,而是对供应商更深的依赖。

当输出只能被消费、不能被学习,企业购买的就是智能租赁;当能力可以被继承、改造和带走,智能才真正成为企业资产。

这样一来,开放与闭源的分界也会改变。

过去,人们主要看模型权重能不能下载;以后,更重要的问题可能是:模型产生的能力能不能被下游继承。

一个权重可以下载、却严格限制训练和衍生开发的模型,未必真正开放;一个通过 API 提供、却允许企业合法蒸馏和迁移能力的模型,也未必完全封闭。

开源 AI 的下一条分界线,可能就从模型能不能带走,变成能力能不能留下。

所以说,这封公开信背后的同盟关系其实很薄弱,每个人都各怀心思。

英伟达希望学生越多越好,因为每个学生都要用算力;OpenAI 接受公开课,但希望保留定价和发放教材的权利;Anthropic 则希望把入场资格和学习方式管得更严。

三方唯一的共识,是不要把蒸馏这项技术整体封死。至于谁能学、能学到什么程度、该向谁付费,远没有谈拢。

过去,AI 公司争的是谁能训练出最聪明的模型。接下来,它们还要争夺谁有权规定智能如何流动。

因为一旦规则确定,模型公司的护城河就不只是自身的参数,还会体现在授权协议、产品条款和每一次 API 调用中。

说到底,蒸馏权的争夺,从来不是 AI 能不能抄作业,是谁有那个本事,把别人的答案,变成自己账上的生产力。