TAG:ZCube

智谱联合清华等提出ZCube组网架构,大模型推理吞吐提升15%,网络成本削减三分之一

智谱联合清华等提出ZCube组网架构,大模型推理吞吐提升15%,网络成本削减三分之一

智谱联合清华大学等在ACM SIGCOMM 2025上提出ZCube网络架构,针对大模型推理中的网络瓶颈。该架构采用扁平化设计,取消Spine层交换机,实现流量负载均衡。在GLM-5.1coding生产环境中,ZCube使GPU推理吞吐提升15%,首Token时延降低40.6%,同时网络成本削减33%。这标志着智算基础设施从通用互联向模型流量驱动的系统协同转变,为大规模AI推理提供了高效经济的解决方案。

2026-05-21 11:45
0
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/