首页
 > 正文

华为推出全球最快AI训练集群Atlas900

  • 编辑时间: 2020-03-27

  9月18日,华为全联接2019(HUAWEI CONNECT)大会上,华为副董事长胡厚崑发布了Atlas 900 AI训练集群,以超强算力带∩给企业人工智能业务的极致体验。世界▔正从数字化向智能化转型,人工智能产业作为关键驱动力,面临自身的升级进化的挑战。华为在超强人工智能算力和大规∏模分布式AI训练集群两个方面加速智能化世界的转型。

  

  ╯╰华为Atlas 900 http://www.bcbj8.com AI训练集群

  Atlas 900 AI 训练集群介绍

  在大型▓数据集上进行训练的神┒经网络架构涵盖从图像识别、自然™⌒语言处理、视频◤实时分析和智能推荐系统等各卐个方面,◇训练这些神经网络模型需要大量浮点计算能力。近年来单个AI处理器算力和训练方法上均取得了重大进步,但︵是在单一机器上,AI训练所需要的时间仍然长得不切实际,因此需要借助大∟规模分布式AI集群环境来提升神经〆网络训练系统的浮点微信群 计算能力。

  此次发布的Atlas 900 AI训练集群由数千颗昇腾910► AI处理器互联构成,是当前全球最快的AI训练集群,代表了当今全球的算力巅峰。其总算力达到256P~1024P FLOPS @FP16,相当于50万台PC的计算能力。

  Atlas 900 AI训练集群领先技术优势

  AI算菠菜微信群 力业界领先

  Atlas 900 AI训练集群采用业界单芯片算力最强的昇腾910 AI处▅▆理器,每颗昇腾910 AI处理器内置32个达芬奇AI Core,单芯片提供比业界高一倍的算力(256TFLↆOPS@FP16)。Atlas 900 AI训练集群将数千颗昇腾910 AI处理器互联,打造业界第一的算力集群。

  昇腾910 AI处理器采用SoC设计,集成“AI算力、通用算力、高速大带宽I/O”,大幅∮度卸载Host┝ CPU的数据预处理任务,″充分提升训╤练〾效率。

  ≯最佳集群网络

  Atlas 900 AI训练集群采用“HCCS、 PCIe 4.0、100G以太”三类高速互联方式,百TB全互联无阻塞专属参数同步网络,降低网络时延,梯度同步Ⅹ时延缩短10~70%。

  在AI服务器内部,昇腾910 AI处理器之间通过HCCS高速总线互联;昇腾910 AI处理器和CPU之间以最新的PCIe 4.0(速率16Gb/s)技术互联,其速率是业界主流采用的PCIe 3.0(8.0Gb/s)技术的两倍,使得数据传输更加快○速和高效。在集群层面,采用面向数据中心的Cloud┙Engine 8800系列交换机,提ぷ供单端口100Gbps的交换速率,将集群内的所有AI服务器接入高速交换网络。

  独创iLossless 智能无损交换算法,对集群内的网络流量进行实时的学习训练,实现网络0丢包与E2E &mu』;s级▫时延。

  系统级调优

?

 ╳ Atlas 900 AI训练集群通过华为集合通信库和作业调度平台,整合HCCS、 PCIe 4.0 和100▲G RoCE三种高速接口,充分释放昇腾910 AI处理器的强大性能。

  华为集合通信库提供训练网络所需的ↇ分布式并行库,通信库+网络拓扑+训练算法进行系统级调优,实现集群线性度>80%,极大提升了作业调♣度效率。

  极致散热系统

  传统数据中心多以风冷技术对设备进行散热,但在人工智能时代传◘统数据中心‖|却面临非『常大的挑战。高功耗器件比如CPU和AI芯片带来更大的热岛效应要求更高效的冷却方式。液冷技术可以满足数据中心高功率、高密部署、低PUE的超高需求。

  Atlas 90√0 AI训练集群采用⿺全液冷方案,创新性设计业界最强柜级密闭绝热技术,支撑>95%液冷◎占比。单机柜支持高达50kW超高散热功耗,实现PUE