首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >云计算这门生意是不是要完蛋了?

云计算这门生意是不是要完蛋了?

作者头像
用户4035096
发布2026-07-13 19:38:22
发布2026-07-13 19:38:22
810
举报

Databricks 最近的财报:年化营收冲到 69 亿美元、同比涨 80%,但是CEO 阿里·戈德西却公开承认毛利率会走低 —— 理由是"agent 跑得太多,把算力吃光了"。消息一出,市场立刻把它放大成"AI 智能体 24/7 跑,云厂商商业逻辑根基要动摇了, 超卖棋局要崩"。这事得拆开聊,超卖没翻车,但也没法假装没发生;

这篇文章回答三个问题:超卖到底是啥?AI Agent 工作负载真的会抹平日内波形吗?未来云厂商可能被吃掉的利润是啥?

1. 超卖到底是什么

云厂商能持续赚钱,靠的不是"卖容量",而是"卖承诺"。一个物理 CPU 核对外可以承诺卖成 4–8 个 vCPU,存储卷在 OpenStack 默认配置下甚至可以 20:1 超卖(OpenStack Cinder 文档)。听起来离谱,但数学上立得住。

逻辑很简单:单个客户的工作负载有波峰波谷,不会 24 小时打满;N 个独立客户的负载叠加之后,波峰会因为相互错开而被"平均掉"。具体一点说:单个客户白天峰值是均值 8 倍很正常,但 64 个独立客户的峰值比均值只会高出 8/√64 = 1 倍。这叫统计复用,超卖的根基就是它。

超卖赌局要成立有三个前提:客户之间的负载互不相关、负载分布在时间上稳定、单客户的峰值是偶发而非持续。任何一个被打破,云厂商就得下调超卖比。AWS 多年下来把 CPU 安全超卖比做到 1:6–1:8,Google 早年做过内部研究(Garraghan et al. 2012),发现集群利用率常态只有 40%–60% —— 绝大多数时间物理资源都空着,超卖不是魔术,是白捡的空闲。

如果你养过“小龙虾”, 你用的是coding plan的大模型套餐, 我相信你会恨不得把模型的套餐内token全都烧完, 不让小龙虾有片刻休息, 才能值回票价的心态!

那么问题来了:AI Agent 一个不会累的客户端,是不是会把所有空闲时间都填满?

2. Agent 的 24/7,是个错觉

直觉上,agent 不睡觉、不午休,应该把云端的负载"摊平"。但企业生产环境和个人用户似乎不一样, 真正去看一个 agent 的运行时,会发现它的内部节奏远比"持续高占用"复杂。

一个 coding agent 一轮任务大概是这样走的:用户派单 → 模型推理(GPU 跑满 6–30 秒)→ 调外部工具/HTTP(IO 受限 0.5–5 秒)→ 写结果到"待 review"队列 → 等待人工 review(GPU 完全空转,可能几小时到几天)→ 通过后触发下一轮。 "24/7 在线"和"24/7 跑满 GPU"是两码事,前者是连接性、后者是算力占用。

按 agent 类型做个粗分层就清楚了:

类型

是不是真 24/7 跑满

量级(粗估)

编程/客服/数据分析 agent

否,跟着人审节奏走

65–80%

SRE / 安全监控 / 量化交易

5–15%

夜间 ETL / 批量内容生成

反而强化峰谷

5–10%

也就是说,真正"能抹平负载"的 agent 是少数派,绝大多数 agent 的负载图谱只是把峰顶推得更高、波形变得更不规则,而不是把它抹平。这层新的方差对云厂商同样可复用 —— 只要这些 agent 来自不同组织、彼此不相关,统计复用继续成立。

注意, 这也只是推论, 毕竟现在 databricks 的数据说明 agent 确实让它们利润下滑了.

这条推论成立的前置条件有两个:agent 必须有外部依赖(调 API、写数据库、等人审),并且来自多个独立组织。如果未来某个大企业的全部 agent 都是单工作流、无人工审核、能 24/7 同步循环——比如全自动量化工厂 —— 那统计复用真的会失效。目前这类 agent 还不是主流,但必须关注。

3. CPU、GPU、电力:超卖被颠覆的程度不一样

把赌局拆到具体资源上,故事的形状完全不一样。

CPU/内存这条线:超卖反而可能走宽。原因是 agent 时代 vCPU 和 GPU 的配比需求正在变化 —— 从 chat bot 时代的 1:8 上升到 coding agent 的 1:4(雪球社区基于 NVIDIA GTC 公开数据测算)。同一个数据中心能容纳的"独立客户数 N"在膨胀,而 vCPU 又有上下文切换、抢占式调度这种天然容错,超卖窗口可能走宽而非走窄。

GPU 这条线:超卖基本玩不动。GPU 推理有显存容量、显存带宽、MIG 切分粒度三道物理约束 —— 多个推理请求可以共享权重读取(这是 batch 摊销成本的来源),但必须同时驻留显存,结果就是 GPU 池的安全超卖比被压在 1.1:1–1.2:1。要么别卖,要么按峰值备。Databricks 毛利率下行的本质原因就在这里:GPU 推理的成本曲线几乎线性追随 token。

电力/制冷这条线:完全没法超卖。Gartner 测算 2026 年全球 AI 数据中心用电量从 95 TWh 跳到 175 TWh(+84%),纳德拉公开讲"现在的瓶颈是电不是算力"。IEA 警告 20% 的计划数据中心可能延迟并网 —— 电网审批周期 3–5 年。这条物理上限反倒成了云厂商的护城河:谁都别想凭空多卖电力。

粗略定性: CPU 池超卖比可能从 1:6–1:8 走宽,GPU 池被压在 1.1:1–1.2:1,电力无超卖可言。所以"超卖逻辑完蛋了"这种简化说法并不准确 —— 它是分资源、分层级的。

4. 价值链上,谁的利润被侵蚀了

芯片层(NVIDIA、AMD、台积电)依旧是最舒服的位置。HBM、CoWoS、先进封装全是技术壁垒,毛利率 75%+ 不在话下。这层吃的是时代红利,AI 推理越普及它越赚。

超大规模云(AWS / Azure / GCP)处于"换挡期"。营收暴涨 —— AWS 2026 Q1 营收 376 亿同比 +28%、Google Cloud 同比 +63%、Azure 同比 +40%(微软 FY26Q3) —— 但毛利率边际下滑。Azure 毛利率从 60% 一路走到 52%,管理层在财报里亲口承认"AI 工作负载推升基础设施投入"。它们不是被推翻,而是被迫从"靠超卖赚轻松钱"切到"靠单价 + 体量赚辛苦钱"。

中间层(Databricks、Snowflake、部分模型 API)才是被 agent 流量反噬最深的那一层。它们按消耗计费,客户用得多 → 收入涨 → 但底层云成本同步涨 → 毛利率被侵蚀。Databricks 的 80% → 74% 就是这个剧本。模型 API 公司(Anthropic / OpenAI)毛利率 <30%,靠和云厂商签长约交换算力,谈判筹码上升但本身不掌握物理资源。

新原生云(CoreWeave、Nebius、Crusoe)反倒有了新机会。CoreWeave 2025 年营收 51 亿、+168%,EBITDA 60%,靠的是 98% 收入绑定长约和能源套利。H100 一年合约价从 1.70 美元/小时涨到 2.35 美元(+40%),B200 续约价被通知 +94% —— 他们不是被冲击的对象,而是新的庄家。

一句话总结: agent 把"按席位收钱的 SaaS"利润,挤回"按 token / 算力收钱的云厂商"和"按硬件 / 能源收钱的芯片 + 电力供应商"手里。中间那层转售商要么转型卖治理(Databricks 推 Unity AI Gateway)、卖编排(Snowflake 推 Cortex AI),要么被边缘化。

总结

  1. "超卖逻辑完蛋"是过度简化 —— 它在被蚕食、被换挡,但没翻车。CPU 池超卖可能走宽、GPU 池超卖被压死在低位、电力压根不能超卖。
  2. 真正的输家是中间层 —— 按消耗计费的 SaaS 数据平台(Databricks、Snowflake)被 agent 流量的成本曲线反噬;超大规模云只是"换挡",芯片和能源供应商反而是最大赢家。
本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-07-09,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 digoal德哥 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 1. 超卖到底是什么
  • 2. Agent 的 24/7,是个错觉
  • 3. CPU、GPU、电力:超卖被颠覆的程度不一样
  • 4. 价值链上,谁的利润被侵蚀了
  • 总结
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档