记录CDH上修改的一些配置

本文主要介绍了如何通过调整配置参数来优化大数据处理系统的性能,包括增加MapReduce执行内存、调整YARN参数、设置HBase region大小等措施,并涉及HDFS的ACL权限设置。

1 加大map,与reduce执行内存,由2改为3

 

yarn.nodemanager.vmem-pmem-ratio默认参数是2.1 调大可以减少物理内存出现不足的情况。
只要参数值*分配的内存>需要的内存值,就不会报错。

3 添加spark shuffle

4 hbase region 大小设置

之前10G 现在改为100G这样减少region split的次数,从而减少出现region is not online 情况发生。

  • 单个ColumnFamilyregion大小,若按照ConstantSizeRegionSplitPolicy策略,超过设置的该值则自动split

 

5 调大map 与reduce 的任务内存值,将map 任务内存调大到4G,CPU虚拟内核调大为4核,之间是1:1的关系

将reduce任务内存和CPU虚拟内核调大为4,之间1:1关系

6 HDFS 的ACL权限设置:

 

转载于:https://www.cnblogs.com/sunt9/p/6686114.html

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值