过去二十多年,计算性能的提升受益于摩尔定律的扩展,性能增长达到了60000倍,如图1所示。然而,同一时期内,I/O带宽仅增长了30倍。当下,如何将高带宽互连扩展到单个机架之外是NVIDIA以及其他厂商都面临的必然挑战。 据行业分析公司LightCounting的分析指出:将 GPU集群从36-72个芯片扩展到500-1000个芯片是加速人工智能训练的最佳选择;在未来3年内,即使是推理集群也可能需要...
网页链接过去二十多年,计算性能的提升受益于摩尔定律的扩展,性能增长达到了60000倍,如图1所示。然而,同一时期内,I/O带宽仅增长了30倍。当下,如何将高带宽互连扩展到单个机架之外是NVIDIA以及其他厂商都面临的必然挑战。 据行业分析公司LightCounting的分析指出:将 GPU集群从36-72个芯片扩展到500-1000个芯片是加速人工智能训练的最佳选择;在未来3年内,即使是推理集群也可能需要...
网页链接
精彩评论