首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >美团不送外卖了?它扔了一颗1.6万亿参数的LongCat-2.0大模型

美团不送外卖了?它扔了一颗1.6万亿参数的LongCat-2.0大模型

作者头像
不惑
发布2026-07-10 21:22:40
发布2026-07-10 21:22:40
2570
举报

6月30日,晚上。

AI圈没人睡得着。

不是因为GPT-5.6,不是因为Claude,不是因为DeepSeek。

是美团。

对,就是你手机里那个黄色袋鼠图标,那个你半夜点烧烤、下雨天叫奶茶的美团。它突然开源了一个大模型,LongCat-2.0,中文名龙猫。1.6万亿参数。全程没用一张英伟达显卡。

海外直接炸了。

image
image

image

一只叫Owl Alpha的猫头鹰,骗了全世界

故事要从一个多月前讲起。

OpenRouter,全球最大的大模型API路由平台,悄悄上线了一个匿名模型,代号Owl Alpha。没人知道它从哪来,没人知道是谁做的。免费,速度快,代码写得贼溜。

开发者们管你是谁,好用就上。

一个月后,数据出来了。这只猫头鹰的总调用量冲进全球前三。在Hermes这个Agent框架里,月调用量全球第一。在Claude Code里,月调用量全球第二,仅次于Claude Opus自己。OpenClaw场景,全球第三。

6月29日,匿名揭开。Owl Alpha就是美团的LongCat-2.0。

海外开发者的反应很统一,什么?那个送外卖的?

X平台上,LongCat-2.0冲上了News榜单,相关推文超过2800条。海外博主普遍把它介绍为中国的DoorDash,然后补一句,但是它比DoorDash大十倍。评论区最经典的一条,一个中国的外卖公司,做出了世界级的大模型,这个世界疯了吗?

Reddit上r/LocalLLaMA板块吵得更凶。一条49分的高赞评论说,All those parameters to not be SOTA. Makes you appreciate what z.ai pulled off.翻译过来,堆了这么多参数都没做到最强,反衬出智谱GLM-5.2的含金量。

另一条更直接,大概和Nemotron Ultra 500B一个水平,一直比GLM-5.1差。

但这些质疑,恰好说明了一件事,LongCat-2.0已经被放进全球最顶尖模型的牌桌上比较了。跟它比的不是外卖平台,是OpenAI,是Anthropic,是DeepSeek。

image
image

image

一张英伟达卡都没有,这才是真正的核弹

参数大不是新闻。1.6万亿,DeepSeek V4 Pro也是这个量级。MoE架构,大家都在用。1M上下文,不算稀奇了。

真正的爆点,藏在一句话里。

LongCat-2.0是业界首个在五万张国产算力卡集群上,完成预训练加推理全流程的万亿参数模型。

翻译成人话,从零开始,在一堆国产芯片上,把一个1.6万亿参数的模型训练到收敛,然后让它稳定跑起来。全程没有碰过一张英伟达显卡。

一个开发者打了个比方,以前国产算力做大模型,相当于房子盖好了,用国产芯片装修一下。这次是从打地基到住进去,全程国产,而且住着居然还挺舒服。

这不是夸张。美团从2023年就开始啃这块硬骨头。三年时间,从千卡到万卡再到五万卡,攻克了算子适配、通信优化、分布式稳定性一堆基础难题。最终,月均日故障率降低70%以上,训练MFU提升1.5倍,日吞吐超过1T tokens。

Reddit上有人根据美团披露的AI ASIC superpod规格反推,认为用的是华为昇腾910C。每张卡大概两个die,每个die配64GB HBM和200Gbps RDMA。关键是软件栈,CANN和HCCL这套生态,跟CUDA的差距,才是真正的命门。美团能在上面把万亿模型跑通,说明他们在底层适配上花的功夫,远比调参重得多。

美国媒体remio.ai的标题很直接,Meituan's LongCat AI Just Trained a Trillion-Parameter Model on Chinese Chips. NVIDIA Was Not Invited.美团的LongCat AI在国产芯片上训出了万亿模型,英伟达没被邀请。

这篇文章还点了一个更关键的事实,同一天,DeepSeek也发布了在华为昇腾上训练的V4模型。两家公司,两个万亿模型,同一天,零英伟达。这不是巧合,这是一个趋势。

image
image

image

97%的稀疏度,MoE这条路撞墙了

技术细节里,有一句话比1.6万亿更值得关注。

LongCat-2.0的MoE稀疏度在不考虑N-gram Embedding的情况下,已经达到约97%。再扩135B专家参数带来的性能增益,可以忽略不计。

什么意思?

MoE模型的核心逻辑,是用一个路由器给每个token挑专家。专家越多,每个token只激活其中一小撮,真正参与计算的参数占比越低。DeepSeek V3是94%稀疏度,V4 Pro是97%,LongCat-2.0也是97%。

当这个比例低到3%以下,再加专家,相当于往一个已经够大的仓库里继续塞书,但每本书被翻到的概率越来越低。美团自己的数据直接说,别扩了,没用了。

这等于宣告了过去两年AI行业拼命堆参数这条路,撞到了天花板。MoE架构的渐近线,就在97%。

那LongCat-2.0把力气花在哪了?

三件事。第一,零计算专家机制。简单token,比如标点符号、助词,直接跳过不计算,省下来的算力给复杂token用。激活参数从固定的一个值变成了一个范围,33B到56B,平均48B。第二,LSA稀疏注意力,百万token的上下文,它不逐字逐句看,智能筛选关键信息,计算量从平方级降到线性。第三,MOPD多专家融合,把Agent专家、推理专家、交互专家三组能力揉在一起,推理时根据任务类型动态调度。

这套组合拳的核心理念很简单,不做大,做精。在固定专家池上榨取更多效率。

跑分不是最强,但开发者用脚投了票

客观说,LongCat-2.0不是跑分最强的模型。

在SWE-bench Pro上拿了59.5,超过GPT-5.5的58.6和Claude Opus 4.6的57.3,但落后于Claude Opus 4.8。在SWE-bench Multilingual上77.3,跟Claude Opus 4.6的77.8基本持平。社区实测反馈,纯coding场景大概跟Nemotron Ultra 500B差不多,文案能力也不突出。

但有一个数据,比任何跑分都有说服力。

OpenRouter的调用量,是开发者用真金白银的token消耗投出来的票。在完全不知道模型是谁家的情况下,LongCat-2.0在Claude Code这个场景里被调用到全球第二。Claude Code是Anthropic自己的地盘,一个中国外卖公司匿名挂上去的模型,能在别人的主场里打到这个位置,说明它在真实代码仓库里端到端干活的能力,确实打到了开发者的痛点。

这也是为什么DMXAPI等平台第一时间上线适配,卖点直接就是仓库级代码理解与端到端任务执行。

36氪的深度分析文章里,一位从业者说得客观,LongCat-2.0和DeepSeek-V4-Pro确实共享同一代MoE范式,说它是复现也不算冤枉。但复现在万亿参数加国产算力的组合下,本身就是一种工程能力证明。能在5万张昇腾上把一个已知配方稳定跑通到收敛,跟拿H100集群照着论文复现,是两个难度量级的事。

美团到底在想什么

一个送外卖的公司,为什么要烧几百亿做AI?

答案很简单,美团不想死。

海外媒体skywork.ai的分析文章写得很透,美团的每一次用户交互,用户点餐、商家管菜单、骑手导航,都是一个AI可以优化或颠覆的决策闭环。如果竞争对手的AI Agent能比美团更准确地理解用户口味、跟餐厅谈判、调度订单,美团就会失去中间商的位置。

当AI Agent成为消费者和服务之间的主要接口,每一个没有自己模型的公司,都会变成别人的附庸。

美团的路线图很清晰。CEO王兴提出了三层AI战略,AI at Work,内部提效,AI编程已经覆盖了27%到52%的新代码。AI in Products,产品升级,AI助手小团和小美已经上线。Building LLMs,自研底座,LongCat就是这一层的果实。

2025年,美团研发投入飙到260亿人民币,比上一年涨了23.5%。那一年,中国外卖行业烧掉了1500亿补贴,美团用精准防御守住了60%的市场份额。然后,调转枪口,全力攻AI。

China Daily Brief的评价很精准,美团不再只是一家外卖公司,它正在进化成一个中国城市生活的基础AI物流层。

image
image

image

外卖停了?不,是外卖不用再卷了

标题党说美团不送外卖了。

真相是,2025年那场烧掉1500亿的外卖大战,已经打完了。

监管层明确喊停非理性价格战,行业从补贴内卷转向创新竞争。美团守住了60%的GTV份额,手上握着1600亿现金,研发投入翻了近四分之一。然后,它把外卖这个基本盘变成了AI的燃料,每天几千万订单积累的调度数据、骑手路线数据、商家运营数据,全成了LongCat的训练养料。

所以美团不是不送外卖了。它是把外卖变成了AI的试验田,然后拿着试验田里种出来的成果,去开垦更大的疆土。

LongCat-2.0开源了,MIT协议。价格定在9.9元5000万token,399元10亿token。对比Claude Opus 4.8动辄几十美元的月费,这个价格差本身就是它能在OpenRouter上吃掉那么大调用量的原因之一。

当然,开源是真的开源还是开源个寂寞,要看社区生态。1.6T参数,Q4量化后还要1TB内存,能本地部署的人,本身就不缺云上API的预算。Reddit上那个Think a 3060 will be enough to run this?的27分玩笑帖,是开源大模型叫好不叫座的真实困境。

最后一句话

LongCat-2.0没有独力改变技术路线的走向。

但它和DeepSeek V4、GLM-5.2、Kimi K2.7一起,拼出了一张新的版图。在这张版图上,中国公司不再只是追赶者,而是用完全自主的算力底座,跑出了世界级的模型。

那个送外卖的美团,造出了一个1.6万亿参数的大模型。

全程没有一张英伟达卡。

而且,它还开源了。

这件事,值得所有关心AI的人,认真想一想。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-07-05,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 技术人说 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 一只叫Owl Alpha的猫头鹰,骗了全世界
  • 一张英伟达卡都没有,这才是真正的核弹
  • 97%的稀疏度,MoE这条路撞墙了
  • 跑分不是最强,但开发者用脚投了票
  • 美团到底在想什么
  • 外卖停了?不,是外卖不用再卷了
  • 最后一句话
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档