登录

中科曙光发布Token加速技术体系打通数据流转堵点


速读:中科曙光是该技术在国内的首次规模化落地。 支持GPU直通网络的IBGDA技术是此次发布的亮点。 数据中心。
中科曙光发布Token加速技术体系 打通数据流转堵点 _ 东方财富网

中科曙光发布Token加速技术体系 打通数据流转堵点

2026年09月14日 16:36

作者:

年悦 记者 张雪

来源:

上海证券报·中国证券网

K图 603019_0

  上证报中国证券网讯(年悦记者张雪) 中科曙光 近日发布Token加速技术体系。该体系以scaleFabric原生无损RDMA为核心网络传输底座,构建算-存-传三级紧耦合的Token加速超级通道,让硬件算力真正转化为模型的实际输出能力。

  Token是大模型处理和输出内容的基础单元,生成效率直接影响模型的响应速度和服务能力。 中科曙光 高速网络互联产品部总工程师万伟在接受采访时表示,算力并不等同于实际产出,算力、网络、存储三者之间的数据流转效率才是决定AI集群实际效能的关键。

  据了解,从模型训练到推理阶段, 海量数据 需要在多块GPU之间分发汇总,一旦出现CPU调度拖累、存储访问卡顿、网络链路抖动,就会造成GPU空转等待,直接拉低集群算力利用率,推高AI业务运行成本。

  此次发布的scaleFabric Token加速技术体系旨在打通数据流转堵点。在计算环节,网卡可以直接读写GPU显存,无需再经过CPU内存中转;IBGDA技术让GPU直接驱动网卡、管理数据传输,将CPU从 通信 调度中解放出来。在存储环节,NVMe over RDMA、XDS、NFS over RDMA三项技术分别负责加速远端NVMe存储访问、支持GPU直接访问远端存储、提升传统文件存储传输效率。

  算存传的紧密协同,降低了数据经过多级交换设备时的传输时延。scaleFabric单跳转发时延低至260纳秒,端到端时延低于1微秒,三跳场景下较主流RoCE方案降低约63%,并且基于严格无损的网络协议,大规模组网时无需依赖PFC,更适合十万卡级别的集群部署。

  支持GPU直通网络的IBGDA技术是此次发布的亮点。 中科曙光 依托scaleFabric网络,已在十万卡级集群中完成验证,并适配DeepEP等 通信 框架,是该技术在国内的首次规模化落地。

  万伟坦言,国产算力卡在单卡性能上与国际高端产品仍有差距,短期内难以追平。现实路径是通过集群和多卡互联,以系统级创新提升整体效率。多卡之间 通信 效率越高,整体算力利用率就越好,IBGDA依托scaleFabric实现规模化应用,意义正在于此。

(文章来源:上海证券报·中国证券网)

主题:基金|新股|行情|美股