Scale-Across协同训推方案

  • 产品与解决方案
  • 行业解决方案
  • 服务
  • 支持
  • 合作伙伴
  • 关于我们

Scale-Across协同训推方案

方案依托高性能 DCI 交换机为核心的长距无损网络,满足单中心扩容与多中心协同训推需求,将分散智算节点整合为逻辑一体的算力集群,并结合跨域统一管理,实现算力的高效联动与灵活配置。

百公里同城协同 提交项目需求
首页产品与解决方案智能联接数据中心网络解决方案Scale-Across协同训推方案

概述

  • 痛点挑战
  • 关键技术
  • 方案优势
  • 相关产品

痛点挑战

  • 长距拥塞响应慢

    物理距离导致传统拥塞通知(CNP)往返延迟过高,引发发送端控速滞后,导致链路利用率下降与多中心间训推业务节奏被拖慢

  • 跨域流量丢包高

    跨域训推业务特有的周期性流量突发,常因交换机缓存有限导致数据积压瞬间溢出,引发严重丢包与重传,造成宝贵的GPU算力持续空转

  • 架构建设成本高

    传统方案依赖OTN电层转发设备,架构冗余导致建设与运维成本高企,更使得带宽升级投入巨大,且难以规避电层转发带来的百微秒级额外时延

  • 跨域运维效率低

    多中心网络互为孤岛,长距链路严重依赖人工运维,缺乏全局视角。面对光纤劣化等隐性故障,系统犹如黑盒,难以支撑多中心间协同训推的高可用需求

关键技术

极速转发架构
51.2T交换容量、400G/800G高速互联、32GB深度缓存、4.5M超大路由表项,轻松应对海量数据转发。
长距无损传输
支持120KM长距互联ZR模块,搭载长距RDMA加速(FastCNP)与距离感知调度,针对长距场景优化,确保算力无损。
全网智能管控
依托AD-DC智算版实现全网流量可视化调度与策略自动部署,长距运维体验如同本地机房。

方案优势

  • 拥塞响应更快

    通过长距RDMA加速技术(FastCNP),将拥塞控制前置于DCI交换机,拥塞响应速度提升81.4%,带动整体吞吐量提升11%,实现微秒级控速,充分释放长距链路吞吐潜力

  • 流量保障更稳

    凭借32GB HBM超大缓存,吸纳长距传输带来的瞬时洪峰,距离感知智能调度技术,动态精准匹配缓存容量,实现零丢包与低时延兼得

  • 建设成本更低

    摒弃传统OTN电层转发架构,采用800G ZR彩光模块直连光层,单根光纤可承载多路800G信号,极大提升单纤总带宽,驱动整体建设成本降低约45%

  • 网络运维更简

    依托AD-DC智算版打破多中心管理边界,实现全网流量可视化调度与策略自动部署,让百公里级网络运维如本地机房般简单

新华三官网
联系我们