首页
学习
活动
专区
圈层
工具
发布

阡视科技发布超节点系统wylon,为Token工厂而生

公司情报专家《财经涂鸦》获悉,7月17日,以“智能伙伴 共创未来”为主题的2026世界人工智能大会暨人工智能全球治理高级别会议(以下简称“WAIC 2026”)在上海正式拉开帷幕。

新一代AI基础设施服务商阡视科技,携最新专为Token工厂而生的超节点真机亮相,沉浸式呈现下一代国产超节点技术的底层智算逻辑与系统级性能拓展路径。

当前,人工智能技术正从推理时计算演进至递归自我改进阶段,长程连续迭代与闭环规划任务成为下一阶段的核心范式。在此范式下,KV Cache的频繁读写使存力成为新的系统瓶颈。传统超节点架构主要侧重于GPU的互联平面,重点解决芯片间横向通信的瓶颈,对于Token工厂场景来说,无法满足超长上下文的运算效率问题。

阡视科技自主研发的专为Token工厂而生的wylon超节点系统,不仅具备横向算力互联,实现了全域无阻塞的卡间全互联通信;还定义了一个新的纵向存力贯通平面,系统打通了异构存力资源的层级架构,构建起百TB级GPU 近存、系统内存以及PB级大带宽闪存空间;同时结合HitenOS大模型操作系统的高效软硬件深度协同设计,在国产GPU平台上实现了“同一速度下更高吞吐,同一吞吐下更快响应”的帕累托改进,可达10倍以上性能的提升。

通过对Token工厂场景的深入分析以及软硬件联合设计研发,wylon超节点系统实现了KV分层管理、算力亲和调度、硬件拓扑感知等底层能力,确保模型负载直达硬件底层,避免中间层性能损耗,为大模型运行提供一体化的高效算力空间,满足Agent时代对大算力、大带宽、大存储的需求,并持续降低Token成本。

此次发布wylon Q72/288单机柜集成72颗国产GPU,4机柜横向互联域扩展至288卡规模,GPU高带宽显存可达18TB,互联总带宽可达72 TB/s,支持FP8/4浮点运算精度,专为KV Cache设计的统一DRAM 缓存可达上百TB,为大模型推理提供一体化的高效算存空间,实现高效稳定的Token生产。

基于wylon超节点架构的wylon新云Token工厂,现已在华东集群节点上线并邀请测试中

Wylon超节点系统深度联合寒武纪、壁仞、沐曦、曦望、海光、摩尔线程等国内GPU芯片翘楚,构建起从芯片到系统、从算力到生态全栈贯通的国产AI基础设施,不断拓展国产超节点系统性能的帕累托前沿。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/O3bbFiOEOYz8jrU0kT91qMtA0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券