扫描下载APP
其它方式登录
文章聚焦大模型推理效率提升新路径,指出行业正从依赖堆叠GPU转向优化网络架构以挖掘存量算力潜力。智谱ZCube组网架构在不增加GPU和更换服务器条件下实现推理吞吐提升15%、尾延迟下降40.6%;OpenAI联合巨头推出MRC网络协议,凸显网络已成为制约万卡级集群性能的核心瓶颈。光模块与交换机等AI网络基础设施需求结构正加速升级。