马斯克也来凑热闹了。
谁也没想到,马斯克和中国大模型之间,竟然上演了一场颇有火药味的“隔空交锋”。
前一秒,他还在夸Kimi:“令人印象深刻。”
后一秒,他就话锋一转,公开表示,自己正在训练的2万亿参数新模型,很快就能完成初始训练,而且:“可能超越Kimi。”
这句话,基本等于当众下战书了。
面对马斯克的隔空“宣战”,Kimi没有发长篇技术报告,也没有摆出一堆排行榜证明自己。

官方只轻飘飘地回了一句:“欢迎马斯克加入2万亿+俱乐部。”
没有愤怒,没有辩解,也没有喊口号。
但这句话,确实有点狠。因为它传递出来的意思是:马斯克,你不是来挑战我们的。
你只是刚刚进入我们已经站着的地方。
事情要从Kimi K3发布说起。
北京时间7月17日凌晨,月之暗面正式推出新一代大模型Kimi K3。官方页面标注的发布日期为7月16日,这主要是时区差异造成的。
Kimi K3总参数达到2.8万亿,拥有100万Token上下文窗口,原生支持视觉理解。每次处理内容时,它并不会把全部参数都调动起来,而是从896个专家模块中激活16个,以降低实际计算成本。
官方称,K3相较Kimi K2,整体扩展效率提升了约2.5倍,并计划在2026年7月27日前公开完整模型权重。
简单翻译一下:这个模型不仅大,还想尽量做到“用得起”。
Kimi K3发布后,很快冲上多个海外评测榜单前列。在前端代码生成榜单上,它一度排到第一;在Artificial Analysis的综合智能指数中排名第三,仅落后于少数最顶尖的闭源模型。

也正是在相关评测报道下面,马斯克留下了一个词:Impressive。
令人印象深刻。
这已经不是马斯克第一次公开夸Kimi了。
今年3月,月之暗面发布Attention Residuals技术论文后,马斯克也曾转发并表示认可。
当时Kimi的回应很有意思:“你的火箭造得也不错!”
一个造火箭的,一个造大模型的,隔着太平洋互相商业吹捧,画面还挺和谐。
可马斯克毕竟是马斯克。
夸完别人之后,下一步通常就是告诉全世界:我也有,而且我的可能更强。
7月18日,他公开透露,旗下团队正在训练一款2万亿参数的新模型,初始训练预计很快完成,性能全面强于此前的1.5万亿参数版本,并表示新模型“可能超越Kimi”。
于是,就有了Kimi那句著名的回应:欢迎加入2万亿+俱乐部。
因为在过去很长一段时间里,中国AI公司面对美国巨头时,习惯使用的词是:
追赶、对标、接近、缩小差距。
我们的模型发布后,最常见的宣传方式也是:接近GPT、媲美Claude、某项能力超过海外模型。
话语权始终掌握在别人手里。美国公司负责制定标准,中国公司负责证明自己达到了标准。
可这一次,情况发生了微妙的变化。马斯克没有说自己的新模型要超越OpenAI,也没有说要打败Claude。
他说的是:可能超越Kimi。
注意这个变化。
当全球最有影响力的科技企业家之一,开始把一家中国公司的模型写进自己的竞争目标时,Kimi就不再只是一个“国产替代品”。
它开始变成同行眼里的参照物。这可能才是“欢迎加入2万亿+俱乐部”真正厉害的地方。
它没有把自己放在挑战者的位置。它把Kimi放在了牌桌上。
当然不是。参数多,不等于模型一定聪明。
一家餐厅有800个厨师,也不代表它做出来的菜一定比米其林餐厅好吃。
模型最终好不好用,还要看训练数据、架构设计、推理效率、工具调用、上下文能力、真实任务完成度,以及使用成本。
Kimi官方自己也承认,K3的综合体验与最强的几款闭源模型之间,依旧存在差距。官方博客明确表示,K3整体性能仍落后于Claude Fable 5和GPT-5.6 Sol;在模型局限性部分,也承认它可能过度主动,在部分场景下会替用户做出意料之外的决定。
所以,不能因为2.8万亿参数,就直接宣布Kimi已经“世界第一”。真正值得关注的,不是参数后面有多少个零,而是Kimi正在尝试同时完成三件事:
把模型做到足够强,把价格压到足够低,再把权重开放出去。
过去,顶级模型通常意味着昂贵、封闭,只能通过少数公司的接口调用。
开发者能用,却摸不到模型本身。
Kimi K3选择开放模型权重,开发者可以自己部署、修改和微调。这意味着更多创业公司和个人开发者,有机会站在一个更强的基础模型上做产品,而不必从头训练。
全球不少投资人和技术从业者关注K3,也不只是因为它来自中国,而是因为一个足够强的开放模型,会直接冲击闭源模型的价格和利润空间。
模型层越卷,调用价格越低,真正受益的还是普通开发者和用户。
马斯克公开说“可能超越Kimi”,当然是在表达技术信心。但千万别忘了,他也是这个世界上最懂流量的人之一。
一句“可能超越Kimi”,既抬高了自己下一代模型的期待值,又借着Kimi K3的热度,提前给产品做了一轮全球预热。
甚至连“还没有完成训练”,都不影响他先发布战报。
这很马斯克。
产品还在训练,发布会已经在社交平台上开完了。Kimi的回应也很聪明。
它没有跟着马斯克进入“谁一定超过谁”的口水战,因为模型最终强不强,还是要等产品上线、公开测试。
它只是用一句玩笑提醒所有人:我们的模型已经发布了。
我们的参数已经做到2.8万亿。你说的那款2万亿参数模型,目前还在训练。
一句话,既接住了马斯克的流量,又没有显得攻击性太强。可以说是情商和技术自信都拉满了。
不是中国公司终于敢“回怼”马斯克了。也不是某一张排行榜上,国产模型暂时超过了美国模型。
排行榜每天都在变化。
今天你第一,明天别人发布一个新版本,排名又可能重新洗牌。真正值得高兴的是,中国大模型正在逐渐摆脱一种状态:
别人发布新技术,我们负责震惊;别人制定游戏规则,我们负责跟随。
从DeepSeek到Kimi,从低成本推理到大规模开放模型,中国团队已经不再满足于做一个便宜版的ChatGPT。
它们开始探索自己的架构,选择自己的技术路线,并把成果开放给全球开发者。
这才是美国科技圈真正紧张的地方。
一个封闭模型再强,影响的可能只是一家公司。一个足够强、足够便宜、还能开放使用的模型,影响的却可能是整个产业。
它会让更多创业者拥有原本只有巨头才用得起的能力。
它也会逼着OpenAI、Anthropic、xAI继续降价、提速、开放更多能力。
竞争一旦开始,谁都别想躺着赚钱。
马斯克说,新模型可能超越Kimi。
Kimi回答:欢迎加入2万亿+俱乐部。
看起来只是一句轻松的玩笑,背后却是中国AI公司正在发生的变化。以前我们需要反复向世界证明:
中国也能做大模型。
现在,一些全球最顶尖的技术公司,已经开始主动研究中国模型、测试中国模型,甚至把中国模型写进自己的竞争目标。
这中间的变化,比任何一句“遥遥领先”都更有说服力。Kimi K3当然还不完美,它也远远没有结束这场比赛。
马斯克的新模型到底能不能超越Kimi,也要等真正发布之后再看。
但至少这一次,中国大模型不再只是站在场边,看着硅谷的巨头互相竞争。
它已经走进了赛场中央。
甚至开始有人指着它说:下一个版本,我们要超过它。
这可能才是Kimi这次最漂亮的一次“回应”。不是因为它赢了马斯克。而是因为马斯克,已经把它当成了对手。