首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >这次真不一样!Kimi K3这次开源,真的掀翻了闭源大模型的牌桌

这次真不一样!Kimi K3这次开源,真的掀翻了闭源大模型的牌桌

作者头像
www.tangshuang.net
发布2026-07-29 20:54:24
发布2026-07-29 20:54:24
280
举报

北京时间7月27晚,也就是美国时间27日早上时刻,Kimi在Hugging Face上正式开源了K3。在之前网传的小道消息中,Kimi正在积极准备开源完整模型权重。然而,当真正开源发生时,技术圈也为之虎躯一震,他们不仅开源了完整的权重,而且连支撑该模型的三项关键基础设施技术也开源,包括推理内核FlashKDA、MoE通信库MoonEP、训练环境AgentEnv整套底层技术栈,这些都是压箱底的技术。而且它采用最开放的MIT许可,开发者可以自己下载,学习、修改,但是它保留了商用授权,这也是非常值得认可的。

在晚间这个时间点开源,非常讲究。我们这边晚上11点,正好是美国那边正好8点左右,美国东部、中部、西部时间还不一样,但是,对于硅谷来说,刚好是那些上班族坐到办公室,打开电脑,刷会儿X,准备工作的时刻。我能想象到,这一天早上,这些美国佬,端着咖啡慢悠悠在工位上刷X,看到K3开源时吃惊,屁股坐不住的跳脚的场景。

为什么这么说?因为,这次Kimi的开源和以往的完全不同,必须只能用「炸裂」来形容。主要有以下几点:

  1. 开源的非常彻底。连MoonEP这种核心技术(在某些公司已经是最高机密)都开源,相当于把整个模型训练、架构、推理,扒开底裤给你看,让你学的明明白白,你只要算力够,你自己也能训练出同水平的定制版K3。
  2. 智能程度达到闭源模型顶级梯队。从社区今天的反馈来看,大家都在说一件事,就是之前(R1之后)的开源,本质上都在追闭源一年多的尾巴,每一次开源,都拿闭源的上两个版本的水平再对标,比如glm-5.2已经够厉害了吧,但是对标的还是opus4.6,deepseek v4 pro甚至只能对标opus4.5。而这次K3,则是直接对标fable-5,虽然确实还差一点,但是已经摸到了顶尖门槛。
  3. 宽松的许可协议。这会使得行业非常活跃,在这些开放代码、模型架构的基础上,原本刚入行的初学者,可以快速上手。那些在某些细节问题上迟迟无法攻克的问题,也可以照葫芦画瓢,迅速解决。你甚至可以直接改底层代码,然后封装一下,说这是自己的模型,能力对标fable-5,没有人会说你。

而这次Kimi的开源,最让人觉得浑身上下最爽的地方,就在于,直接对着对面贴脸开大,把桌子掀翻。

在此前,Claude的CEO Dario还阴阳怪气的说,“K3是蒸馏了我们一个未发布的版本……”,打着“安全”的幌子,然后过又在那里酸滋滋说“不反对开源”。

好与不好,坏与不坏,都不是你们可以随意定义的,还是要看用户的脚如何投票。

不管是中国还是美国,那些之前用着高额订阅费的企业用户,之前没得选,Qwen虽然便宜,但是智能度不够,而现在,他们终于可以拥有顶级智能的本地安全模型使用。甚至,针对自己的企业内部数据,可以做二次训练。

完全开放的态度,让K3模型具备任意演变的可能。这次Cursor可以光明正大的给K3套皮,说这是Composer-K3模型了。

Kimi保留了K3商业化使用的授权。我觉得这是非常好的,是有必要的。开源并不免费,这应该成为常识。一方面是让开源变得有实际的利益价值,另一方面也可以让使用的企业更有底气,不用担惊受怕。这有利于中国企业快速上线K3服务,进而让我们普通用户在原有的coding plan中使用高智模型。同时,其实也有利于美国以及其他国家的企业,在部署K3之后,也可以获得来自官方的稳定支持。

虽然现在美国在加紧研究制定限制中国开源模型的法律,但是,广大中小企业的利益和意志,必然让这个事情举步艰难。所有人都会想同一个问题:凭什么有开源的高智模型我不用,要去用你费用高昂、没有隐私、随时断供的云端模型?

这或许,就是中国企业走了一条与美国企业完全不同的开源道路的核心原因所在。

中国企业在算力上无法拿到美国模型厂商同水平的算力,但是,在算法和架构上取得了巨大突破。通过开源,争取AI桌上的话语权。美国试图通过技术封锁、芯片禁令、人才挖脚等方式,打压中国AI的发展,然而,却没想到中国人的意志力如此坚韧。越是打压,我们越是强壮。

这次K3还针对国产芯片做了适配,也就是说,可以在国产芯片上跑,现在,华为、阿里等旗下的芯片都已经适配可用。这对一些经济次级国家的企业非常有诱惑力,使用不到1/10的价格,就能自主拥有包括芯片在内的顶级智能模型服务,Kimi不仅让自己出了名,也会实实在在带动整个中国模型产业链,在类似东南亚、中亚、中东等地区的销售。当然,至今为止,中国没有发布任何有关向美国公司销售中国芯片的禁令。

最后再来聊聊Kimi这家公司,和创始人杨植麟。

就在两天前,美国一家媒体把多家AI公司的执掌人做了一个封面,马斯克、奥特曼,都是正常的照片,唯独把杨植麟的肖像,用一张讽刺漫画放在一起,歧视感和敌意拉满。

我们中国有句古话,“越是丑化你,越是说明你已经让他感到危机与自卑”。如果不是Kimi的巨大成功,他们还可以舒舒服服地收token租。今天,K3用实力狠狠打了他们的脸。他们感到了恐慌,感到了落寞,不自觉的用丑化创始人的方式,来展现自己的无知和傲慢。

杨植麟是清华学霸,后来去卡内基梅隆大学读博士,之后回国创业创办月之暗面。美国互联网有帖子讨论:“为什么杨植麟不留在美国?”说的好像留在美国是一件多么棒的值得炫耀的事一样。而杨植麟自己认为,美国并不是什么了不起的地方,中国也能做出引领世界的科技产品。

对于Kimi这家公司,其实也走了一些弯路。2023年,大模型元年,那个时候,Kimi通过投广告,做到头部,那个时候,你打开B站,10个视频里面就有1个是Kimi。曾经“支持200万上下文”的所谓“技术突破”的新闻热极一时。但是这种通过砸钱买流量的模式,现在来看,在技术每日一更的那个时候,简直就是作茧自缚固步自封。

事情发生变化是在智谱和MiniMax上市之后。作为同期(甚至更早)起来的创业公司,这两家企业的上市给了Kimi团队沉重的心理打击。据之前的报道,Kimi内部迅速调整战略,把核心力量集中在技术探索和突破,“不急于寻求上市”。随后,Kimi专注code这块,推出coding plan、kimi code,现在又推出kimi work。K3的成功,本质上,就是这个团队化蛹成蝶,经历了痛苦的心理煎熬之后,不轻言放弃,脚踏实地做技术突破,在那次战略转移后开出的最美之花。

这也让我再次确信,技术的创新和突破,比营销宣传更能让一个企业走得更远。

虽然,中国的大模型厂商们都很努力,各家都有自己的旗舰,智谱的glm-5.2,阿里的qwen-3.8,字节的seed-2.1。但是,我还是要把中国最闪亮的两顶皇冠,戴在deepseek-r1和kimi-k3的头上。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-07-28,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 唐霜 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档