首页
学习
活动
专区
圈层
工具
发布

面向Agent时代:英伟达Groq 3 LPX投产,超大规模智算迎来新选择

日英伟达官宣 Groq 3 LPX 机架推理系统完成全面投产,同时披露新一代 Vera Rubin 平台实测性能数据,这标志英伟达面向 AI 智能体时代的推理硬件正式商业化落地。

测试数据显示,Vera Rubin NVL72 在 AgentX 智能体工作负载下,每兆瓦吞吐量达到上一代 GB300 NVL72 的 30 倍,单 Token 推理成本最高降低 35 倍。Groq 3 LPX 机架在 10 万 Token 超长上下文测试场景下,输出 Token 速度达到每秒 3400 个,针对长上下文大模型、AI 智能体、实时交互业务做深度优化。

AI生成

英伟达已经通知微软、谷歌等顶级云厂商,下一代 Grace Blackwell、Vera Rubin 服务器将上调售价,整体涨幅超过 15%,部分系统涨幅接近 17%。按照测算,一座 1GW 规模 AI 数据中心,仅仅硬件涨价就会带来至少 50 亿美元额外资本开支。

涨价背后根源是 HBM、DRAM 存储价格持续上行,TrendForce 数据显示二季度 DRAM 合约价环比大幅上涨,存储成本已经成为 AI 算力最大的成本项。

行业观点认为,英伟达持续迭代推理硬件,瞄准当下火热的 AI 智能体赛道。Agent 应用对低延迟、大上下文吞吐能力提出极高要求,传统 GPU 方案面临瓶颈。但硬件涨价也会抬升全球智算中心建设门槛,中小算力厂商压力加大,也会倒逼国产算力方案加速追赶。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OvN4KXV3LaFS6UxTyXVOdTTA0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券