首页科技正文

欧博备用网址:华为AI训练集群是什么? 华为AI训练集群Atlas900有多快?

admin2021-10-02230华为AI训练集群

网易科技讯 9月18日消息,华为全联接2019大会上,华为副董事长胡厚昆宣布了Atlas 900 AI实习集群。此次宣布的Atlas 900 AI实习集群由数千颗升腾910 AI处置赏罚器互联组成,是当前全球最快的AI实习集群,代表了当今全球的算力巅峰。其总算力到达256P~1024P FLOPS @FP16,相等于50万台PC的计算手段。

AI算力领先

Atlas 900 AI实习集群接纳业界单芯片算力最强的升腾910 AI处置赏罚器,每颗升腾910 AI处置赏罚器内置32个达芬奇AI Core,单芯片提供比业界高一倍的算力。Atlas 900 AI实习集群将数千颗升腾910 AI处置赏罚器互联,打造业界第一的算力集群。

升腾910 AI处置赏罚器接纳SoC设计,集成“AI算力、通用算力、高速大带宽I/O”,大幅度卸载Host CPU的数据预处置赏罚使命,充实提升实习遵从。

最佳集群网络

Atlas 900 AI实习集群接纳“HCCS、 PCIe 4.0、100G以太”三类高速互联方式,百TB全互联无壅闭专属参数同步网络,降低网络时延,梯度同步时延缩短10~70%。

在AI处事器内部,升腾910 AI处置赏罚器之间通过HCCS高速总线互联;升腾910 AI处置赏罚器和CPU之间以最新的PCIe 4.0(速率16Gb/s)技术互联,其速率是业界主流接纳的PCIe 3.0(8.0Gb/s)技术的两倍,使得数据传输越发快速和高效。在集群层面,接纳面向数据中心的CloudEngine 8800系列交换机,提供单端口100Gbps的交换速率,将集群内的所有AI处事器接入高速交换网络。

独创iLossless 智能无损交换算法,对集群内的网络流量举行实时的学习实习,实现网络0丢包与E2E μs级时延。

系统级调优

Atlas 900 AI实习集群通过华为荟萃通讯库和作业调治平台,整合HCCS、 PCIe 4.0和100G RoCE三种高速接口,充实释放升腾910 AI处置赏罚器的强盛性能。

华为荟萃通讯库提供实习网络所需的漫衍式并行库,通讯库+网络拓扑+实习算法举行系统级调优,实现集群线性度>80%,极大提升了作业调治遵从。

散热系统

传统数据中心多以风冷技术对装备举行散热,但在人工智能时代传统数据中心却面临很是大的挑战。高功耗器件好比CPU和AI芯片带来更大的热岛效应要求更高效的冷却方式。液冷技术可以满足数据中心高功率、高密陈设、低PUE的超高需求。

Atlas 900 AI实习集群接纳全液冷方案,创新性设计业界最强柜级密闭绝热技术,支持>95%液冷占比。单机柜支持高达50kW超高散热功耗,实现PUE<1.1的极致数据中心能源遵从。

其它,在空间节省方面,与8kW风冷机柜对比,节省机房空间79%。极致的液冷散热技术满足了高功率、高密装备陈设、低PUE的需求,极大地降低了客户的TCO。

据相识,华为已在华为云上陈设了一个Atlas 900 AI实习集群,集群局限为1024颗升腾910 AI处置赏罚器。基于当前最典型的“ResNet-50 v1.5模子”和“ImageNet-1k数据集”,Atlas 900AI实习集群只需59.8秒就可完成实习,排名全球第一。

“ImageNet-1k数据集”包罗128万张图片,精度为75.9%,在同等精度下,其他两家业界主流厂家测试结果分别是70.2s和76.8s,Atlas 900 AI实习集群比第2名快15%。

Atlas 900 AI集群首要为大型数据集神经网络实习提供超强算力,可普及应用于科学研究与商业创新,让研究职员更快地举行图像、视频和语音等AI模子实习,让人类更高效地试探宇宙秘密、预测天气、勘探石油和加速自动驾驶的商用历程。

-------------------------

欧搏官网

www.05328888.com欢迎进入欧搏平台(Allbet Gaming),欧搏平台开放欧搏(Allbet)开户、欧搏(Allbet)代理开户、欧搏(Allbet)电脑客户端、欧搏(Allbet)APP下载等业务。

网友评论

1条评论

最新评论