7月17日凌晨,月之暗面发布Kimi K3。2.8万亿参数,全球最大开源模型。
接下来的96小时里,三件事同时发生。
马斯克第一天点赞"Impressive",第二天就宣布要训练2万亿参数的Grok 4.6来"超越Kimi"。
OpenAI战略未来负责人Dean Ball发长文,给开源模型扣了一顶"减速主义"的帽子。
月之暗面自己呢?服务器被挤爆,被迫暂停C端新用户订阅。
一家中国公司发布一个开源模型,48小时内让美国两家头部AI公司同时失态。这种场面,上一次出现还是DeepSeek。
先还原时间线。这件事的节奏比电视剧还紧凑。
从点赞到叫板,马斯克只用了不到24小时。
这个转变速度本身就说明问题。如果K3只是个普通模型,马斯克根本不会第二天就急着宣布对标产品。他手上的Grok 4.5刚发布不到两周,正常节奏应该是跑完评测再迭代。但他等不了了。
更有意思的是月之暗面的回应。官方微博直接@马斯克:"欢迎加入2万亿+俱乐部"。
一句话,既接住了招,又亮出了底气。
3月份的时候,马斯克转发过Kimi的论文并评价"令人印象深刻"。当时月之暗面回了一句"你的火箭造得也不错"。一来一回,看起来是惺惺相惜。但这次不一样。马斯克点赞之后立刻放狠话,态度转变之快,恰恰暴露了他真实的压力水平。
如果说马斯克的反应是"竞争焦虑",那OpenAI的反应就更有意思了。
Dean Ball,OpenAI新成立的战略未来团队负责人,前白宫科技政策办公室AI高级政策顾问。这个人的身份很微妙——他不是技术负责人,是政策战略负责人。一个管政策的人,主动跳出来评价别家的模型,这本身就是一种信号。
Ball说了什么?
他先承认K3是"非常好的模型",性能不能简单归因于蒸馏。然后话锋一转,把重点放在了开源路线上。他的核心论点是:当越来越多接近前沿水平的模型可以免费下载、部署和修改时,闭源模型依靠技术稀缺性建立的商业壁垒将受到冲击。
翻译一下:你们把好东西免费送,我们收费的生意就不好做了。
然后他抛出了那个最具争议的判断——
"开放权重模型看似加快了技术传播,却可能削弱行业继续扩大AI资本开支的动力。我将开放权重称为一种'减速主义(Decelerationist)'力量。"
这顶帽子扣得非常精妙。
他不说开源不好,他说开源会"减速"。不是减技术的速,是减商业回报的速,是减企业继续投入数百亿美元训练下一代模型的积极性的速。
这个逻辑链条是:开源模型逼近前沿→闭源模型卖不上价→企业不愿再投钱→AI整体进步放缓。
听起来很有道理?但仔细想想,这个逻辑有一个致命漏洞。
它假设只有商业回报才能驱动技术进步。而Kimi K3本身就是反例——月之暗面不是靠卖闭源API赚了钱才做出K3的,恰恰是在开源路线下,通过技术架构创新(KDA注意力机制、注意力残差、Moon Clip二阶优化器)把2.8万亿参数的模型做到了扩展效率提升2.5倍。
开源没有减速。它只是减速了OpenAI的商业模式。
除了马斯克和OpenAI的官方表态,还有第三股力量:质疑K3是"蒸馏小模型"。
这个说法在技术社区流传了几天,没有任何实锤,但传播力很强。逻辑很简单:你一个中国公司,突然做出接近Fable 5和GPT-5.6 Sol的模型,肯定是蒸馏了别人的大模型吧?
月之暗面企业业务负责人黄震昕在7月21日直面回应。
"K3性能跃升的核心来自底层原创架构创新,并非对现有模型蒸馏复刻。"
他披露了三项关键技术:Moon Clip二阶优化器,首次应用于大模型训练,"能让20T训练数据跑出40T的训练效果";Kimi Linear Tension线性注意力机制,解决超长任务性能衰减;Attention Residuals注意力残差,让推理效率同步提升25%。
这些不是蒸馏能蒸馏出来的。蒸馏是把大模型的知识压缩到小模型里,它不会给你新的架构创新,不会让你的扩展效率提升2.5倍。
Dean Ball自己也承认了这一点。他在长文里明确写道:K3"表现并不能简单归因于模型蒸馏"。
但质疑声还是传了几天。这本身就很说明问题——当一个中国团队做出世界级模型时,第一反应不是"他们怎么做到的",而是"他们是不是抄的"。
这种偏见,才是真正需要被减速的东西。
K3发布后48小时,月之暗面做了一个让很多人意外的决定:暂停C端新用户订阅。
原因很直接:用户请求量逼近GPU集群承载极限,推理排队时间拉长,如果继续放新用户进来,存量付费老用户的体验会严重受损。
"宁可暂时放弃新增收入,也要守住付费客户的使用体验底线。"黄震昕说。
这是一个商业判断,也是一个信号。它说明月之暗面很清楚自己的短板:算力不够。
但有意思的是,算力不够,定价却不低。
据第三方机构Artificial Analysis测算,Kimi K3单任务成本约0.94美元,与GPT-5.6 Sol的1.04美元接近,约为Claude Opus 4.8(1.80美元)的一半。
黄震昕说了一句话,值得记住:
"开源模型、中国大模型不该被贴上低价标签。我们做出了SOTA级模型,也能匹配合理商业定价。"
这是一个转折点。中国开源模型第一次不靠便宜打仗,而是靠技术实力打到与海外头部模型同台竞技的价格带。
几乎与K3风暴同步,彭博社7月22日报道:月之暗面计划以投前500亿美元估值启动IPO前最后一轮融资,最快6个月内赴港上市。
半年前,这个数字是315亿美元。
支撑这个估值跳涨的,不是PPT,是数据。截至6月中旬,月之暗面ARR突破3亿美元。K3发布当天,ARR创下历史最大单日增幅。海外付费用户增长400%,API收入增长400%,产品进入200多个国家和地区。
杨植麟,1992年出生,清华本科,卡内基梅隆博士,Transformer-XL和XLNet的核心作者。高中时玩摇滚乐队,公司名字来自平克·弗洛伊德的专辑《月之暗面》。
第一天点赞,第二天叫板。Grok 4.5发布不到两周就急着预告4.6。Colossus集群20万块GPU,却要追一个中国300人团队的开源模型。
派政策负责人而非技术负责人出面。不说技术不行,说开源"减速"。真正怕的不是K3的性能,是K3的免费。
两种失态,指向同一个事实:中国开源模型第一次站到了编程能力的世界之巅。
Frontend Code Arena榜单上,K3以1679分登顶。这是有史以来第一次,开源模型在这个权威编程榜单上超越全部海外闭源模型。
从K2.6的第18名到K3的第1名,一代模型,跳了17个名次。七个前端编程细分方向,六个第一。
更关键的是,7月27日,月之暗面将完整开源K3模型权重,面向全球开发者开放商用。
这意味着什么?意味着全世界任何开发者都可以免费下载、部署、修改一个接近GPT-5.6 Sol水平的模型。不需要向OpenAI付API费,不需要向Anthropic付订阅费。
这才是Dean Ball真正害怕的事。不是K3本身,是K3之后还会有K4、K5,是Qwen 3.8、DeepSeek V5也会跟进,是开源模型会像潮水一样持续冲击闭源的定价城墙。
他的恐惧是有道理的。只是他把这种恐惧包装成了"为行业担忧",把商业模式的危机包装成了"减速主义"的学术判断。
月之暗面黄震昕在回应中说了最后一段话,值得放在这里:
"可能这次的这个(K3)表现,让他们得到一点震撼的感觉。现在拭目以待,希望他们出来跟我们掰一掰手腕。"
马斯克说"有望超越Kimi"。月之暗面说"欢迎掰手腕"。
一个在炫耀自己即将做出的东西,一个在展示自己已经做出的东西。
这就是2026年7月的AI格局。中国团队不再是追赶者,而是被追赶的人。
马斯克知道。OpenAI也知道。所以他们才急了。
参考信源:百度百家号/钱江晚报7月21日|每日经济新闻7月22日|云头条7月20日|新浪财经7月22日|知乎/环球市场播报7月21日|彭博社7月22日
本文为犀牛伯爵原创观察,不构成投资建议。
谢谢你看我的文章。