调整YARN
本主题仅适用于YARN群集,并介绍如何为群集调整和优化YARN。
注意:下载Cloudera YARN调整电子表格以帮助计算YARN配置。 有关简短视频概述,请参阅调整YARN应用程序。
概观
此概述提供YARN群集的抽象描述和YARN调整的目标。

YARN群集由主机组成。 主机提供内存和CPU资源。 vcore或虚拟核心是主机CPU的使用份额。

调整YARN主要包括在工作主机上最佳地定义容器。 您可以将容器视为由内存和vcores组成的矩形图。 容器执行任务。

有些任务使用大量内存,对大量数据的处理最少。
其他任务需要大量处理能力,但使用的内存较少。例如,蒙特卡罗模拟评估许多可能的“如果?”场景在相对较小的数据集上使用大量处理能力。

YARN ResourceManager分配内存和vcores以尽可能以最有效的方式使用所有可用资源。理想情况下,很少或没有资源闲置。

应用程序是由一个或多个任务组成的YARN客户端程序。通常,任务使用容器中的所有可用资源。任务不能超过其指定的分配,确保它不能使用所有主机CPU周期或超过其内存分配。

通过将容器配置为使用除开销和其他服务所需的所有可用资源之外,调整YARN主机以优化vcores和内存的使用。

YARN调整有三个阶段。这些阶段对应于YARN调整电子表格中的选项卡。

1、群集配置,您可以在其中配置主机。
2、YARN配置,您可以量化内存和vcores。
3、MapReduce配置,您可以为特定map和reduce任务分配最小和最大资源。

YARN和MapReduce具有许多可配置的属性。有关完整列表,请参阅Cloudera Manager配置属性。 YARN调整电子表格列出了这些属性的基本子集,这些属性最有可能提高常见MapReduce应用程序的性能。

群集配置
在Cluster Configuration选项卡中,您可以为YARN实现定义工作主机配置和群集大小。

机器配置
第1步:工作者主机配置 //表格中写单个主机配置
在下面的输入框中输入您可能的机器配置。 如果您不确定您计划购买哪种机器,请提供一些适合您预期购买的最小值。
与任何系统一样,可用的内存和CPU资源越多,集群处理大量数据的速度就越快。 具有4个带超线程的CPU的机器,每个CPU有6个内核,每个主机提供48个vcore。

2个单元服务器安装中的3 TB硬盘驱动器在JBOD(Just a Bunch Of Disks)配置中有12个可用插槽,这是在创建电子表格时性能和价格之间的合理平衡。 存储成本会随着时间的推移而降低,因此您可能会考虑使用4 TB磁盘。 较大的磁盘价格昂贵,并非所有用例都需要。

两个1千兆位以太网端口在电子表格发布时提供了足够的吞吐量,但10千兆位以太网端口是价格低于速度的选择。

第2步:工人主持人计划
现在您已从步骤1获得基本主机配置,请使用下表将资源(主要是CPU和内存)分配给在主机上运行的各种软件组件。
从您的操作系统开始至少8 GB,为Cloudera Manager开始至少1 GB。 如果CDH以外的服务需要其他资源,请在“其他服务”下添加这些数字。

HDFS DataNode使用至少1个内核和大约1 GB内存。 相同的要求适用于YARN NodeManager。
电子表格列出了几个可选服务:

 Impala守护程序需要至少16 GB的守护程序。HBase Region Servers需要12-16 GB的内存。Solr服务器至少需要1 GB的内存。Kudu平板电脑服务器至少需要1 GB的内存。

任何剩余资源都可用于YARN应用程序(Spark和MapReduce)。 在此示例中,有44个CPU内核可用。 在每个物理核心上设置所需的vcores乘数,以计算总可用vcores。

第3步:群集大小
定义了群集中每个主机的规范后,输入支持业务案例所需的工作主机数。 要了解并行计算的好处,请将主机数设置为最小值10。
YARN配置

在YARN Configuration选项卡上,验证可用资源并设置每个容器的最小和最大限制。

第4步:在群集上配置YARN
这些是群集的第一组配置值。 您可以在YARN-> Configuration中设置这些值
步骤4和5:验证设置
步骤4从步骤2中提取内存和vcore编号。
步骤5显示群集的总内存和vcores。
转到资源管理器Web UI(通常是http:// :8088 /并验证“内存总计”和“Vcores Total”与上面的值匹配。如果您的机器没有坏节点,那么数字应该完全匹配。

步骤6:验证群集上的容器设置
为了让YARN作业干净地运行,您需要配置容器属性。
在步骤6中,您可以更改影响容器大小的值。
最小vcores数应为1.当需要额外的vcores时,一次添加1将导致最有效的分配。 将vcore预留的最大数量设置为节点的大小。
设置内存的最小和最大预留。 增量应该是可以影响性能的最小量。 这里,最小值约为1 GB,最大值约为8 GB,增量为512 MB。

步骤6A:集群容器容量
本节将告诉您群集的容量(就容器而言)。
步骤6A允许您根据输入的数字验证群集中容器的最小和最大数量。
最大可能容器数,基于内存配置
最大可能容器数,基于vcore配置
基于每个磁盘轴2个容器的容器编号
根据内存配置,最小可能容器数
根据vcore配置,最小可能容器数

步骤6B:容器健全检查
本节将针对主机在STEP 6中对容器参数进行一些基本检查。

MapReduce配置
在MapReduce Configuration选项卡上,您可以规划增加的特定于任务的内存容量。
第7步:MapReduce配置
对于CDH 5.5及更高版本,我们建议仅为map和reduce任务指定堆或容器大小。 未指定的值将根据设置mapreduce.job.heap.memory-mb.ratio计算。 此计算遵循Cloudera Manager并根据比率和容器大小计算堆大小。
步骤7A:MapReduce完整性检查
完整性检查MapReduce设置对容器的最小/最大属性。
通过步骤7A,您可以一目了然地确认所有最小和最大资源分配都在您设置的参数范围内。

连续调度
启用或禁用连续调度会更改YARN连续或基于节点心跳调度的频率。 对于较大的群集(超过75个节点)看到繁重的YARN工作负载,建议通常使用以下设置禁用连续调度:

 yarn.scheduler.fair.continuous-scheduling-enabled应为falseyarn.scheduler.fair.assignmultiple应该是真的

在大型群集上,连续调度可能导致ResourceManager无响应,因为连续调度会遍历群集中的所有节点。

有关连续调度调优的更多信息,请参阅以下知识库文章:FairScheduler使用assignmultiple调整和连续调度

我们没有75个节点,设置为yarn.scheduler.fair.continuous-scheduling-enabled 为true
yarn.scheduler.fair.assignmultiple = true

小结:
yarn中容器内存的计算方法
yarn.nodemanager.resource.memory-mb
容器虚拟 CPU 内核
yarn.nodemanager.resource.cpu-vcores
//这2个值是更具最后用到的资源剩下来 多少给yarn的
提示:如果yarn.nodemanager.resource.memory-mb=2G yarn.nodemanager.resource.cpu-vcores=2 4个节点那么在192.168.0.142:8088/cluster 界面上就会有 “Memory Total=8G” “ VCores Total=8”

最小容器内存
yarn.scheduler.minimum-allocation-mb = 1G //推荐值
最小容器虚拟 CPU 内核数量
yarn.scheduler.minimum-allocation-vcores = 1 //推荐值
最大容器内存
yarn.scheduler.maximum-allocation-mb = < yarn.nodemanager.resource.memory-mb
最大容器虚拟 CPU 内核数量
yarn.scheduler.maximum-allocation-vcores = < yarn.nodemanager.resource.cpu-vcores //推荐值
容器内存增量
yarn.scheduler.increment-allocation-mb = 512M
容器虚拟 CPU 内核增量
yarn.scheduler.increment-allocation-vcores = 1 //推荐值

ApplicationMaster 虚拟 CPU 内核
yarn.app.mapreduce.am.resource.cpu-vcores = 1 //推荐值
ApplicationMaster 内存
yarn.app.mapreduce.am.resource.mb = 1024M
ApplicationMaster Java 选项库
yarn.app.mapreduce.am.command-opts = -Djava.net.preferIPv4Stack=true -Xmx768m

堆与容器大小之比
mapreduce.job.heap.memory-mb.ratio = 0.8 默认
Map 任务 CPU 虚拟内核
mapreduce.map.cpu.vcores = 1
Map 任务内存
mapreduce.map.memory.mb = 1024
Map 任务 Java 选项库
mapreduce.map.java.opts = 忽视 ignored
I/O 排序内存缓冲 (MiB)
mapreduce.task.io.sort.mb = 400
Reduce 任务 CPU 虚拟内核
mapreduce.reduce.cpu.vcores = 1
Reduce 任务内存
mapreduce.reduce.memory.mb = 1024M
Reduce 任务 Java 选项库
mapreduce.reduce.java.opts 忽视

Map 任务最大堆栈 819 //是 mapreduce.map.memory.mb 0.8
Reduce 任务最大堆栈 819M //mapreduce.reduce.memory.mb 0.8
ApplicationMaster Java 最大堆栈 819.2 //这个数字是yarn.app.mapreduce.am.resource.mb * 0.8得到的
链接中,有建议的值,但是我们这是测试集群,资源很小,生产集群上具体见链接最后的建议值

参考链接:
https://www.cloudera.com/documentation/enterprise/5-13-x/topics/cdh_ig_yarn_tuning.html
CDH5性能调优 http://blog.hylstudio.cn/archives/488

CDH6.3.2之YARN生产环境调优(yarn 生产必做优化项)相关推荐

  1. K8S云平台环境调优说明

    随着云计算技术的不断发展,在信息化建设模式上上云是大势所趋.在搭建完云平台环境后,需要对服务器以及部署产品进行优化处理,如:MySQL.Nginx.Redis等. 在项目上线过程中遇到了服务器性能瓶颈 ...

  2. 性能调优之JMH必知必会1:什么是JMH

    性能调优之JMH必知必会1:什么是JMH JMH必知必会系列文章(持续更新) 一.前言 二.什么是JMH 1.JMH简介 2.JMH入门 3.使用JMH进行微基准测试 JMH必知必会系列文章(持续更新 ...

  3. Java虚拟机这一块 —— JVM 调优和深入了解性能优化

    JVM 调优和深入了解性能优化 JVM 调优的本质 GC 调优原则 调优的原则 目的 GC 调优 调优步骤 日志分析 阅读 GC 日志 -XX:+UseSerialGC -XX:+UseParNewG ...

  4. 性能调优之JMH必知必会2:JMH的基本用法

    性能调优之JMH必知必会2:JMH的基本用法 JMH必知必会系列文章(持续更新) 一.前言 二.JMH的基本用法 1.添加JMH依赖包 2.@Benchmark 2.@Warmup和@Measurem ...

  5. 【Elasticsearch】Elasticsearch性能调优:千万不要做愚蠢的事

    1.概述 在 Elasticsearch 中有一些热点,人们可能不可避免的会碰到. 我们理解的,所有的调整就是为了优化,但是这些调整,你真的不需要理会它.因为它们经常会被乱用,从而造成系统的不稳定或者 ...

  6. 生产环境中on yarn模式是否采用yarn session

    flink on yarn包括 yarn session以及per job两种方式. 那么生产环境中到底采用哪种呢? 下面是社区群中的讨论: 所以on yarn模式在生产环境中我们使用per job ...

  7. 从MapReduce的Shuffle原理 进行 生产参数调优

    文章目录 1.mapreduce的过程上图 2.map 切分输入文件 3.环形缓冲区 3.1 原理 3.2 生产调优 3.2.1 mapreduce.task.io.sort.mb(default:1 ...

  8. Yarn资源分配性能调优

    日志: Container [pid=134663,containerID=container_1430287094897_0049_02_067966] is running beyond phys ...

  9. 【JVM 学习笔记 05】:JVM性能调优工具的使用和优化案例

    [JVM 学习笔记 05]:JVM性能调优工具的使用 1. 使用 jstat(命令行工具) 查看线上系统的JVM运行状况 1.1 常用命令 1.2 使用技巧 1.2.1 随着系统运行,每秒钟会在年轻代 ...

最新文章

  1. 知识工场 | 知识图谱暑假班开始报名啦!
  2. Git之常用命令的综合使用和示例分析
  3. 【Linux】一步一步学Linux——group文件详解(108)
  4. 驻定相位原理(POSP)以及线性调频信号的频谱
  5. 【笔记】Linux的目录配置(a2)
  6. 机器学习经典算法笔记——线性回归
  7. 【CSAPP笔记】4. 汇编语言——基础知识
  8. 栈和递归---手动实现一个栈和蒜头君吃桃
  9. LInux 查看环境变量
  10. FutureTask源码解析(2)——深入理解FutureTask
  11. Java数字图像处理基础-------图像二值化处理
  12. RTI DDS. c++11例子 -1
  13. 关于路由器的一些认识(有些不够严谨)
  14. XTP中CXTPReportControl中合并单元格
  15. python接入excel_Excel 借助 Python 连接 WorkBench,实现 Excel 输入参数返回结果
  16. 设计模式之9 - 装饰模式Decorator
  17. python爬取某站上海租房图片
  18. 全球与中国环氧腻子棒市场现状及未来发展趋势
  19. Task1.2 A.I. 发展史
  20. 分享一种简易的直流电机正反转限位电路

热门文章

  1. matlab 行 读取文件 跳过_用Matlab处理LAS点云(1)——LAS文件概述
  2. 【直播预告】第四范式Intel AI应用与异构内存编程挑战赛专场活动开启报名
  3. 制造工业中的机器学习应用:I概览
  4. AI之matlab随笔(1)-数据类型,逻辑操作,数组,逻辑运算,异或,零向量或零矩阵
  5. 【小白学习PyTorch教程】六、基于CIFAR-10 数据集,使用PyTorch 从头开始​​构建图像分类模型...
  6. 【NLP】CMU MILA 谷歌 | 三家巨头发布史上最干文本增强总结
  7. 【Python】100行Python代码轻松开发个人博客
  8. 【论文解读】从BERT和XLNet到MPNet
  9. 重磅!2K图像90FPS,中科院开源轻量级通用人脸检测器
  10. Python爬虫介绍及实战入门