一个月前,月之暗面同时找上微软、亚马逊和谷歌,希望让K3进入Azure、AWS和Google Cloud,并从相关服务产生的收入里分走一部分。
最高30%的数字被摆上了谈判桌,但当时谁都不知道,这笔账最后能不能谈成。
现在,第一个答案出来了:Kimi真的把收费站修进AWS了。
美国时间9月18日,AWS正式宣布Kimi K3上线Amazon Bedrock。全球企业开发者可以直接在AWS里调用这款模型,按Token付费。
而且月之暗面并不是唯一一个开始向海外云平台收钱的中国模型厂商,9月16日,智谱也在电话交流会上披露,与多家国内外头部云服务商签署了收入分成协议。
中国模型,开始一起算海外这笔账了。
实际上,K3此前已经可以通过Microsoft Foundry调用,但微软走的是第三方路径:底层推理由Fireworks AI提供,Foundry主要负责模型接入、部署和企业治理。
用户虽然是在微软的平台里调用K3,但推理服务背后还隔着Fireworks。
AWS这次不一样,它自己就是K3的托管和推理服务提供方。
K3现在是Amazon Bedrock里的正式托管模型,AWS自己负责承接调用和计费。
AWS给K3的标价为:全球标准档输入3美元/百万Token,输出15美元/百万Token,和月之暗面官方API价格完全一致;美国区域则分别为3.3美元和16.5美元。
一个月前,这件事还只停留在谈判桌上。
8月26日,路透社援引三名知情人士报道,月之暗面正在同时和微软、亚马逊、谷歌谈判,希望让K3进入Azure、AWS和Google Cloud,并从三大云上K3相关服务产生的收入中拿到最高30%。
但“30%”当时只是月之暗面的谈判条件,谈判仍处于早期阶段。月之暗面和三大云厂商还没有解决具体怎么分钱、数据能开放到什么程度,以及如何审计K3实际消耗的Token。
现在,三大云里,AWS率先把K3摆上了货架。
尽管双方协议未公开,具体分成比例乃至授权方式目前都无法确认,但有一件事是可以确定的:AWS和月之暗面至少已经谈成了一套单独的商业条款。
K3在自己的许可证里写得很清楚:月之暗面允许普通开发者下载、部署和商业使用K3,但如果一家企业及其关联方经营MaaS业务,连续12个月总收入超过2000万美元,那么在把K3用于商业用途前,必须先和月之暗面另行达成协议。
AWS显然远超“连续12个月总收入超过2000万美元”这个门槛,且Bedrock做的正是典型的MaaS——AWS负责托管模型,企业通过API调用,再按照Token付费。
顺便一提,K3目前也已经进入阿里云百炼。
百炼目前同时提供两种K3服务:一种由月之暗面直供,另一种则由阿里云自己部署和提供推理。后者和AWS的逻辑类似,阿里云作为MaaS平台商业化提供K3,同样需要遵守K3许可证里的单独授权要求。
也就是说,AWS并非唯一一个已经和月之暗面把这笔商业账谈下来的云厂商。
接下来,就看微软和谷歌会不会也跟上了。
Bedrock并不缺开放权重模型。
今年2月,AWS一次性把DeepSeek V3.2、MiniMax M2.1、GLM 4.7、GLM 4.7 Flash、Kimi K2.5和Qwen3 Coder Next六款模型接进Bedrock;AWS自己也说,从2025年以来,Bedrock已经加入数十款来自DeepSeek、MiniMax、Qwen、Mistral、NVIDIA等厂商的开放权重模型。
AWS愿意单独和月之暗面谈K3,首先还是因为K3本身有足够强的使用价值。
K3有100万Token上下文、原生视觉能力,AWS把它明确定位在长时间Coding、知识工作和Agent任务上。
它还是Bedrock第一款支持显式Prompt Caching的开放权重模型,开发者可以主动控制哪些Prompt内容被缓存,长任务里反复使用相同代码库、工具说明或参考文档时,有助于降低输入成本和延迟。
而且——我们在前一篇文章里也提到——K3恰好很适合放在云上卖。
企业想用K3,大致有三条路:自己部署、直接买Kimi官方API,或者通过云平台调用。
自己部署,K3有2.8万亿总参数,官方建议最好使用64个或更多加速器组成的超节点;直接买官方API,国内企业要走认证、充值和配额体系,海外用户还要面对独立账户体系、网络稳定性和销售沟通。
AWS抢的就是第三条路:把这些接入、采购和运维成本都包进企业本来就在用的云平台里。
许可证只能保留谈判权,不能制造谈判筹码。
云厂商愿不愿意接受额外授权,只取决于一个非常简单的逻辑:这个模型有没有足够多的需求。只要不上K3会让用户和Token流向别的平台,AWS就有理由和月之暗面谈这笔生意。
K3现在至少证明了开放权重和商业收费并不冲突。只要模型本身足够有吸引力,原厂依然可以保留收费权。
过去一年,中国模型已经越来越多地出现在海外开发者平台、企业云和API市场里。
路透社9月16日的数据显示,截至9月14日,DeepSeek、智谱、腾讯和阿里在OpenRouter上的合计市场份额已经达到45%;MiniMax大约60%的销售额来自海外。中国模型靠低价、开放权重和越来越接近美国头部模型的能力,已经拿走了一块真实的海外需求。
这种压力甚至已经传到了最头部的美国模型公司。
9月19日,路透社在报道Anthropic考虑提前推出新模型时直接指出,除了OpenAI刚刚发布的GPT-6 Astra,低成本、部署灵活的开放权重模型,也正在成为Anthropic和OpenAI越来越重要的竞争对手。
换句话说,中国模型走到今天,已经不是“美国开发者愿不愿意试一试”的问题了。模型有人用,海外有收入,连Anthropic都开始把中国的开放模型当成必须面对的竞争对手。
下一步自然就是:这些需求产生的钱,要能更多地回到训练模型的人手里。
过去,海外云平台拿到中国开放模型,可以自己托管、卖API、收Token费。模型越火,平台的生意越好,但原厂未必能从这部分收入里持续分钱。
Kimi正在改变这件事。它继续开放权重,却在许可证里给大型MaaS平台留了一道收费口。现在AWS接受了这道门槛,月之暗面也迈出了真正意义上的第一步。
中国模型不只要去海外抢用户,也开始从海外云平台手里赚钱。
有意思的是,K3在AWS美国区域的价格还比全球标准档高10%。美国企业想在AWS自己的地盘上调用Kimi,甚至还得多付一点钱。
而这件事已经开始在中国模型厂商中扩散。
9月16日,智谱在面向分析师和投资人的电话会上披露,公司已经与多家国内外头部云服务商签署收入分成协议。GLM系列开放权重模型将以托管API形式进入海外云平台,双方按照约定比例分钱,相关收入从10月开始确认。
这部分增量甚至已经被写进了增长预期:智谱把年末ARR指引从24亿美元上调到30亿美元,目前全业务口径ARR约18亿美元。
阿里也已经被路透社曝出,准备在下一代Qwen3.8-Max上采用类似机制:模型继续开放权重,但大型商业用户围绕它赚钱,也要和阿里分一杯羹。
Kimi已经收到了钱,智谱已经签了协议,Qwen也在准备。
下一版DeepSeek、MiniMax以及更多中国开放权重模型,如果也开始重新设计自己的商业许可,与大型云服务商谈收入分成,我一点都不会意外。
毕竟,既然海外云厂商已经可以靠中国模型卖Token,中国模型公司没有理由继续把这笔钱全部留在别人的账上。
