今天不分享产品了,闲聊点儿有的没的。
7 月底,月之暗面发布了 Kimi K3。
这个模型有 2.8 万亿参数,每次运行实际激活约 1040 亿参数,上下文达到 100 万 Token。
Kimi 自己发的论文倒也没回避差距:综合能力仍然低于 Claude Fable 5 和 GPT-5.6 Sol 这样的最强闭源模型,但已经进入最前沿模型的能力区间。
然后,月之暗面做了一件很有意思的事:
把完整模型权重放了出来。
不是只能去 Kimi 官网用,也不是必须调用月之暗面的 API。你可以下载,可以自己部署,可以微调,也可以拿它做自己的产品。
Kimi K3 的许可证明确允许使用、复制、修改、发布、分发、再授权甚至销售衍生版本。
但许可证里还有另一句话:
如果你是一家提供“大模型即服务”的公司,比如把 Kimi K3 部署好,再通过 API 卖给别人,而且过去连续 12 个月公司及关联方收入超过 2000 万美元,就必须先和月之暗面单独签商业协议。
外媒有报道称,一些商业协议的收入分成比例最高可能达到 30%。
这就出现了一个以前看起来有点矛盾的商业模式:
模型给你,权重给你,甚至允许你改,等你真的靠它做成了一门大生意,我们再来谈钱。
我觉得这可能是中国大模型正在探索的一条很重要的路线。
同样的模式,阿里也在学。
8月3日,阿里发布 Qwen3.8-Max。
它有 2.4 万亿参数、每次激活约 950 亿参数,最长支持约 100 万 Token 上下文。
更重要的是,阿里同样决定把 Max 级别模型的底层权重开放出来。
路透社8月7日报道时,这件事还只是计划:阿里准备学习 Kimi K3,对大型商业用户增加收费或收入分成安排。
现在许可证已经真的出来了,规则也类似:
普通开发者仍然可以免费下载、部署、修改 Qwen3.8。
但如果一家公司拿它做“模型即服务”,或者做类似 AI 编程、AI 办公助手这样的产品,并且公司及关联方连续 12 个月收入超过 5000 万美元,就必须另外获得 Qwen 的商业许可。
也就是说,它并没有向普通开发者收费。
一个独立开发者拿 Qwen 做 App,不收费;一家中小企业部署到自己的服务器里,也不收费;企业内部自己使用,也明确不受这条限制。
只有等你真的把它做成一门几千万美元的生意,阿里才来找你谈商业授权。
这个商业模式的设计非常聪明/狡猾。
因为模型公司最需要的时候——模型刚发布、需要开发者使用、需要生态、需要各种应用替它验证能力,你使用它的门槛几乎为零。
等生态真的长大,再从最有支付能力的那部分人身上赚钱。不是先收费再获客,而是先开放,再从其中挣到钱的那部分生意上收费。
严格来说,阿里并没有把 Qwen3.8-Max 的所有东西都免费放出来。
公开下载的是底层的 Qwen3.8-2.4T-A95B 权重。
它目前是纯文本模型,原生上下文 26 万 Token,可以扩展到约 100 万;而阿里云上的完整 Qwen3.8-Max 还提供视觉输入、默认 100 万上下文、关闭思考模式以及官方内置工具等功能。
所以阿里的模式其实比“开放模型,然后收费”更有意思。
这种商业模式隐约形成了三层结构:
第一层,开放权重。免费,让开发者下载、部署、微调,尽可能扩大生态。
第二层,云服务。不想自己买机器、搭推理系统、处理扩容和稳定性的公司,可以直接在阿里云上调用。
第三层,商业授权。真正靠 Qwen 做大规模模型服务或者 AI 办公产品的公司,再单独谈许可。
这不是传统意义上的“免费开源”,更像是:
把模型本身变成获客入口,把收费点往后移。
那么,问题来了,为什么中国的大模型公司会更愿意这样做?
很简单,因为我们已经把 Token 价格打下来了。
对比看下,DeepSeek、Qwen、智谱等中国模型的价格,一度只有美国头部模型的 1/10 到 1/20。
当 API 本身越来越便宜,死守 API 单价未必是一门最好的生意。
这时候,开放权重反而有一个很现实的价值:先让全世界开发者用你的模型。
2025 年 4 月,Qwen 系列全球下载量已经超过 3 亿次,衍生模型超过 10 万个;
到当年 10 月,仅 Hugging Face 上基于 Qwen 做出的衍生模型就已经超过 18 万个。
这些数字本身不直接产生收入,但它会产生一种更重要的好东西:开发者习惯。
一家创业公司从第一天就用 Qwen,工程师熟悉它,微调数据围绕它积累,推理框架针对它优化,几年之后再换模型,成本就开始出现了。
于是阿里不一定非要从第一次 Token 调用就挣钱。
它可以从 GPU、云计算、模型托管、推理服务、企业部署、工具链,以及最后的大客户商业许可里赚钱。
今年 5 月,阿里云收入同比增长 38%;AI 相关产品已经贡献其外部客户收入的 30%。阿里预计,大约一年后这个比例可能超过 50%。
当然,也不能把阿里云的增长简单归功于 Qwen 开放,但至少已经可以说明一件事:
开放模型一定不等于赚不到钱。
这其实是在重新回答一个老问题:为什么我要把最值钱的东西送给别人?
我们看海外巨头,OpenAI 和 Anthropic 的答案就很清楚:不送。
最先进的模型放在自己的服务器里,开发者想用,就按 Token 付钱。
模型越强,API 越贵,理论上模型能力和收入直接挂钩。
这是一条很干净的商业路线,但它也意味着一件事:客户和模型公司的关系,本质上是一笔一笔的 API 交易。
而开放权重走的是另一种逻辑:
我先让尽可能多的人围绕我的模型开发,再想办法从整个生态里赚钱。
这两者其实很像过去软件产业里两种完全不同的竞争方式。
一种靠卖软件许可证,另一种把核心软件开放,最后靠云、服务、企业支持和生态赚钱。
只是现在,大模型训练一次可能花掉几十亿甚至更多,所以过去很多人一直怀疑:这么贵的东西,怎么可能免费放出来?
Kimi K3 和 Qwen3.8 给出的答案是:
可以免费给绝大多数人,但没必要免费给所有人。
当然,也不是大家想象中的那种“真正开源”。
这里需要把一个词讲清楚,国内媒体经常把 Kimi、Qwen、Llama 都叫“开源模型”,但严格来说,更准确的叫法其实是开放权重模型。
因为真正的开源 AI,按照 Open Source Initiative 的定义,不只是给模型参数,还需要让使用者能够充分研究、修改和再分发系统,并提供足够的训练数据说明和训练代码。
Kimi K3 和 Qwen3.8 又都加入了针对大型商业使用者的限制。
所以它们并不是传统软件世界里 Apache、MIT 那种“拿走以后基本不再管你”的开源方式。
所以中国公司可能正在创造的不是“免费模型”,而是一种新的商业许可证。
小开发者免费,企业内部免费,生态伙伴免费起步,真正开始规模化赚钱了,再收费。
也就是说,这和“为了理想开源”关系不大,是非常商业的行为。
Kimi K3 有 2.8 万亿参数,Qwen3.8 有 2.4 万亿参数。这种规模的模型,你把文件免费下载下来,并不意味着普通公司真的愿意自己运行。
光 Qwen3.8 在 Hugging Face 上的模型文件就接近 4.9TB。
真正大规模部署还需要 GPU、推理优化、负载均衡、监控和工程团队。
所以一个看起来很矛盾的事情会发生:模型越开放,云服务反而可能越有价值。
因为开放解决的是“我有没有选择权?”云解决的是“我为什么要自己折腾?”
这也是 DigitalOcean、Together AI 这样的公司愿意和月之暗面合作的原因。
它们不是简单把模型文件下载下来转卖,而是靠推理优化、Token 利用率、部署效率和服务能力挣钱。
真正值钱的东西,开始从“我拥有这个模型”,往“我能把这个模型运行得多便宜、多稳定、多好用”移动。
对 OpenAI 和 Anthropic 来说,如果 Kimi、Qwen 永远比 GPT、Claude 差很多,其实问题也不大。
企业还是会为最好的能力买单,真正麻烦的是另一种情况:
开放模型已经做到闭源模型 90%—95% 的能力,但价格只有几分之一,而且还允许自己部署。
Kimi 自己的论文虽然已经明确承认 K3 仍然落后于 Fable 5 和 GPT-5.6 Sol,但同时认为它已经达到 frontier 水平。
另一方面,Kimi K3 的 Token 成本大约只有 Anthropic Fable 的三分之一。
这时候客户就会开始算账:
客服机器人真的需要全球第一的模型吗?
内部知识库需要吗?
每天跑 100 万次的数据整理需要吗?
大量 Agent 的普通步骤需要吗?
很多场景的答案可能都是“不需要”。
于是最强闭源模型依然可以卖得很贵,但真正海量的普通任务,可能慢慢流向便宜的开放模型。
这会产生一个很重要的结果:
开放模型不一定要打败最强模型,只要足够接近,就可以压低最强模型的定价权。
这和我之前有一篇讲的“企业开始看单位任务成本”,其实是同一件事情的另一面。
过去我们讨论中美大模型竞争,基本就是:谁 Benchmark 更高、谁参数更多、谁追上了谁。
但 Kimi K3 和 Qwen3.8 让我觉得,接下来更值得关注的是另一件事:中国公司会不会先跑出一种不同于美国头部模型公司的商业模式。
OpenAI、Anthropic 目前更接近:
最好的模型 → 不开放权重 → API / 订阅收费。
Kimi、Qwen 正在尝试的则更像:
接近最前沿的模型 → 开放权重 → 免费扩大生态 → 云和推理服务赚钱 → 超大商业客户再收费。
哪条路线最后利润更高,现在远远没有答案。
还有就是开放也有非常明显的风险。
模型被别人拿去优化,可能把自己的 API 生意打没;开发者可能使用模型,却永远不向原厂付一分钱;商业授权如果限制越来越多,又会削弱开放生态最重要的吸引力。
所以这并不是一个已经被证明了的成功模式,但有一点已经变了。
过去讨论开放模型,最大的质疑一直是:“都给别人了,你靠什么赚钱?”
现在 Kimi 和阿里正在给出一个新的答案:不一定要靠卖模型本身赚钱。
以上,祝你今天开心。

