谷歌近日在Cloud Next大会上发布了其最新的AI超级计算机架构,重点介绍了TPU v5p芯片和A3 GPU实例。TPU v5p是谷歌第五代张量处理单元,专为大规模AI训练和推理设计,性能较前代提升显著,并已向云客户开放预览。同时,A3实例基于NVIDIA H100 GPU,配备高性能网络,旨在加速生成式AI和大型语言模型的训练。
该架构通过优化互连和资源调度,实现了高达10倍的计算性能提升,并支持多租户环境下的高效资源利用。谷歌表示,这些技术将帮助企业和研究机构更高效地部署AI工作负载,降低训练成本,推动AI应用的规模化落地。