9月18日,华为全联接2019(HUAWEI CONNECT)大会上,华为副董事长胡厚崑发布了Atlas 900 AI训练集群,以超强算力带给企业人工智能业务的极致体验。世界正从数字化向智能化转型,人工智能产业作为关键驱动力,面临自身的升级进化的挑战。华为在超强人工智能算力和大规模分布式AI训练集群两个方面加速智能化世界的转型。

图1 华为Atlas 900 AI训练集群

Atlas 900 AI 训练集群介绍

在大型数据集上进行训练的神经网络架构涵盖从图像识别、自然语言处理、视频实时分析和智能推荐系统等各个方面,训练这些神经网络模型需要大量浮点计算能力。近年来单个AI处理器算力和训练方法上均取得了重大进步,但是在单一机器上,AI训练所需要的时间仍然长得不切实际,因此需要借助大规模分布式AI集群环境来提升神经网络训练系统的浮点计算能力。

此次发布的Atlas 900 AI训练集群由数千颗昇腾910 AI处理器互联构成,是当前全球最快的AI训练集群,代表了当今全球的算力巅峰。其总算力达到256P~1024P FLOPS @FP16,相当于50万台PC的计算能力。

Atlas 900 AI训练集群领先技术优势

AI算力业界领先

Atlas 900 AI训练集群采用业界单芯片算力最强的昇腾910 AI处理器,每颗昇腾910 AI处理器内置32个达芬奇AI Core,单芯片提供比业界高一倍的算力(256TFLOPS@FP16)。Atlas 900 AI训练集群将数千颗昇腾910 AI处理器互联,打造业界第一的算力集群。

昇腾910 AI处理器采用SoC设计,集成“AI算力、通用算力、高速大带宽I/O”,大幅度卸载Host CPU的数据预处理任务,充分提升训练效率。

最佳集群网络

Atlas 900 AI训练集群采用“HCCS、 PCIe 4.0、100G以太”三类高速互联方式,百TB全互联无阻塞专属参数同步网络,降低网络时延,梯度同步时延缩短10~70%。

在AI服务器内部,昇腾910 AI处理器之间通过HCCS高速总线互联;昇腾910 AI处理器和CPU之间以最新的PCIe 4.0(速率16Gb/s)技术互联,其速率是业界主流采用的PCIe 3.0(8.0Gb/s)技术的两倍,使得数据传输更加快速和高效。在集群层面,采用面向数据中心的CloudEngine 8800系列交换机,提供单端口100Gbps的交换速率,将集群内的所有AI服务器接入高速交换网络。

独创iLossless 智能无损交换算法,对集群内的网络流量进行实时的学习训练,实现网络0丢包与E2E μs级时延。

系统级调优

Atlas 900 AI训练集群通过华为集合通信库和作业调度平台,整合HCCS、 PCIe 4.0 和100G RoCE三种高速接口,充分释放昇腾910 AI处理器的强大性能。

华为集合通信库提供训练网络所需的分布式并行库,通信库+网络拓扑+训练算法进行系统级调优,实现集群线性度>80%,极大提升了作业调度效率。

极致散热系统

传统数据中心多以风冷技术对设备进行散热,但在人工智能时代传统数据中心却面临非常大的挑战。高功耗器件比如CPU和AI芯片带来更大的热岛效应要求更高效的冷却方式。液冷技术可以满足数据中心高功率、高密部署、低PUE的超高需求。

Atlas 900 AI训练集群采用全液冷方案,创新性设计业界最强柜级密闭绝热技术,支撑>95%液冷占比。单机柜支持高达50kW超高散热功耗,实现PUE<1.1的极致数据中心能源效率。

另外,在空间节省方面,与8kW风冷机柜相比,节省机房空间79%。极致的液冷散热技术满足了高功率、高密设备部署、低PUE的需求,极大地降低了客户的TCO。

Atlas 900AI训练集群领先的Benchmark指标

华为已在华为云上部署了一个Atlas 900 AI训练集群,集群规模为1024颗昇腾910 AI处理器。基于当前最典型的ResNet-50 v1.5模型”和“ ImageNet-1k数据集”,Atlas 900AI训练集群只需59.8秒就可完成训练,排名全球第一。

“ ImageNet-1k数据集”包含128万张图片,精度为75.9%,在同等精度下,其他两家业界主流厂家测试成绩分别是70.2s和76.8s,Atlas 900 AI训练集群比第2名快15%。

图2  基于“ResNet-50 v1.5模型”和“ ImageNet-1k数据集”的测试数据

Atlas 900 AI 集群适用场景

Atlas 900 AI集群主要为大型数据集神经网络训练提供超强算力,可广泛应用于科学研究与商业创新,让研究人员更快地进行图像、视频和语音等AI模型训练,让人类更高效地探索宇宙奥秘、预测天气、勘探石油和加速自动驾驶的商用进程。

Atlas 900 AI集群也可以提供云服务,以云的方式提供充裕的、经济的算力资源,简单易用、高效率、全流程的AI平台,为客户带来极致体验的“易获取、用得起、方便用”的普惠AI算力。

— 【 THE END 】—

往期精彩文章回顾:

办公室小野与爆米花视频身亡女孩家属和解:补偿金额保密

女子将车垂直开上标志杆,警方回应...

淘宝可以改名字了?并没有!当初的年少轻狂,现在的不忍直视...

华为推出全球最快AI训练集群Atlas 900,算力超群相关推荐

  1. 重磅 | 华为发布绝杀计算战略!投15亿美元打造开放生态,全球最快AI训练集群Atlas 900,绝了!...

          戳蓝字"CSDN云计算"关注我们哦! 文 | 阿晶.丹丹.王银发于上海华为HC大会现场 出品 | CSDN云计算(ID:CSDNcloud) 科技的不断发展正逐步加速智 ...

  2. 华为全球最快AI训练集群Atlas 900诞生

    作者 | 胡巍巍 来源 | CSDN(ID:CSDNnews) 你,和计算有什么关系? 早上,你打开手机App,查看天气预报,和计算有关: 中午,你打开支付宝人脸支付,买了份宫保鸡丁,也和计算有关. ...

  3. 华为全球最快 AI 训练集群 Atlas 900 诞生!

    作者 | 胡巍巍 出品 | CSDN(ID:CSDNnews) 你,和计算有什么关系? 早上,你打开手机App,查看天气预报,和计算有关: 中午,你打开支付宝人脸支付,买了份宫保鸡丁,也和计算有关. ...

  4. 马斯克发布机器人,“钢铁侠”那种!特斯拉推出全球最快AI计算机,自研芯片那种...

    NEW 关注Tech逆向思维视频号 最新视频→[最骇人的5起自动驾驶"杀人"事故] 来源|智能车参考 文|贾浩楠 韦丽雪 褚万博 全球最快的AI训练速度王座,刚刚易主了. 不是英伟 ...

  5. 超大规模AI异构计算集群的设计和优化

    现在业界有一个很大的趋势是训练规模越来越大的模型.从GPT-3开始,模型已经被推到了千亿参数量的维度.从2020年到现在,各个厂商也在不断推出更大参数量的模型,比如OpenAI的GPT-3.Googl ...

  6. 大快搜索命名集群时一直出现该名称已存在

    大快搜索命名集群时一直出现该名称已存在 个人解决方法: 重装前面在网站上操作安装的库(所有) 问题可能只出在MySQL数据库的安装上,但我没验证过,索性全部重装了

  7. 华为发布全世界最快AI产品,集成1024颗业内最强芯片,训练ResNet-50只需59.8秒

    乾明 李根 发自 凹非寺  量子位 报道 | 公众号 QbitAI 不止5G和鸿蒙,华为最新大招,扔出AI计算核弹. 刚刚,华为全联接大会开幕,推出又一重量级AI产品Atlas900. 此前接受外媒采 ...

  8. 全球十大AI训练芯片大盘点:华为昇腾910是中国唯一入选

    乾明 编辑整理  量子位 报道 | 公众号 QbitAI AI芯片哪家强?现在,有直接的对比与参考了. 英国一名资深芯片工程师James W. Hanlon,盘点了当前十大AI训练芯片. 并给出了各个 ...

  9. Meta为元宇宙建全球最快AI超算,1.6万个A100 GPU,英伟达都赚麻了

    晓查 发自 凹非寺 量子位 | 公众号 QbitAI 今天,扎克伯格宣布,Meta要建造全球最快的AI超级计算机,而且就在2022年年中建成. 这台超算被命名为"AI研究超级集群" ...

最新文章

  1. Lintcode18 Subsets II solution 题解
  2. 计算机网络基础:局域网协议相关知识
  3. [心得]Ubuntu無法ssh登入
  4. node之post提交上传
  5. Java实现动画逐字打印
  6. ubuntu中安装mongodb注意事项
  7. delphi 调用 c# 写的webservice
  8. 【渝粤教育】国家开放大学2018年秋季 0222-21T模拟电子电路 参考试题
  9. 使用 C# 开发智能手机软件:推箱子(十)
  10. 软件的接口设计图_软件产品研发流程
  11. 晶振波形不是正弦波_求助各位!有源晶振出来的波形是方波还是正弦波?
  12. (一)SLAM拓扑地图(地图的生成和显示)
  13. vue-element-admin 快捷标签导航(三)
  14. HTML怎么设置下划线?html文字加下划线方法
  15. C#配置文件之App.config和.settings
  16. office365邮箱设置
  17. Polarion ALM数据库解析2 – SQL示例之ASPICE追溯性的查询语句
  18. it转正述职报告_it转正述职报告
  19. 线性布局html,线性布局中的layout_weight属性
  20. easyExcel导入失败提示用户第几行有误并回滚数据

热门文章

  1. JAVA 多线程 JAVA 如何开发一个自定义线程池
  2. Android 系统(240)---底层如何简易的获取一个从AP传下来的parameter(flag)
  3. Android 系统(132)---ODM 开发用户常见需求文档(六)
  4. AI(1 )---人脸识别在各个行业的典型盈利模式
  5. camera---(3)双camera 生态链
  6. mac上用VMWare虚拟机装Ubuntu,搞定了
  7. 如何编译Linux kernel
  8. 炫酷插件_PS如何做炫酷动图?推荐5款黑科技PS插件(3D动态|分散粒子|烟雾特效..)帮你轻松实现...
  9. 果然十三香!苹果全球销量超越小米重回第二,第一还是它
  10. 我混了大半辈子,忽然成了拆二代