> 数据图表

我想了解一下15

2025-12-0
我想了解一下15
15华安研究• 拓展投资价值64 TPU v7 Cube拓扑图2.4 OCS是如何实现Cube间的互连的?⚫ Cube内部通过铜缆背板、PCB进行极高速的电信号通信,外部通过OCS走光纤链路。为了提供3D环面网络所需的环绕链接,相对的两个面上的链接必须连接到同一个光电路交换机。• 如右图,TPU (4,1,4) 在Z+方向上没有内部相邻的TPU,因此它将使用一个800G光收发器,通过光纤连接至分配给Z轴的光路交换机(OCS),该OCS被配置为将此连接导向立方体的Z-侧,从而连接到TPU (4,1,1)。⚫ 一个机架有6个外立面,每个外立面引出16条光互联链路,合计96条光互联链路。64个机架,96*64=6144条光互联链路;144个机架,合计13824(144*96)条光互联链路。⚫ TPU v4集群采用136×136 端口配置(含 8 个冗余端口)的OCS光交换机,故所需OCS数量为6144/(136-8)=48台;而v7集群有望采用320×320端口配置(含32个冗余端口)的OCS,故所需OCS数量为13824/(320-32)=48台。⚫ 即,4096个TPU v4组成的集群中,TPU数量和OCS光交换机的比例约为85:1;9216个TPU v7组成的集群中,该比例为192:1。资料来源:SemiAnalysis、Google Research、金融界观点、新浪财经、 Jouppi, et al.《TPUv4: AnOptically Reconfigurable Supercomputer for Machine Learning with Hardware Support for Embeddings》、架构师技术联盟、全产业链研究院、华安证券研究所华安证券研究所