首页
学习
活动
专区
圈层
工具
发布

小鹏在单颗图灵芯片上运行完整通用大模型 推理速度超20Tokens/秒

【小鹏在单颗图灵芯片上运行完整通用大模型 推理速度超20Tokens/秒】《科创板日报》27日讯,小鹏汽车通用智能中心负责人刘先明今日下午透露,小鹏已通过XLLM架构,在单颗图灵芯片上运行完整的通用大模型。该架构可在较短时间内对通用大模型进行优化,使其能够在单颗图灵芯片上高效运行,推理平均每秒生成超过20个Tokens,可用于类似ChatGPT、豆包的推理及应用。小鹏将其视为图灵芯片从汽车、机器人进一步向本地算力场景扩展的一项探索。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/Ojlr1bFLRahVg0bDBIgfWm0A0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券