hadoop配置项笔记 - yarn
hadoop版本:3.1.1
yarn-site.xml
yarn.log-aggregation-enable
作用:是否开启任务日志收集
默认值:false
我的设置:true
yarn.log-aggregation.retain-seconds
作用:日志自动清理前保存多长时间,单位秒。
默认值:-1
我的设置:864000
yarn.log-aggregation.retain-check-interval-seconds
作用:检查日志保留与否的时间间隔,单位秒。
默认值:-1 如果为0或负值,则计算为yarn.log-aggregation.retain-seconds的1/10.
我的设置:-1
yarn.resourcemanager.nodes.include-path
yarn.resourcemanager.nodes.exclude-path
作用:控制或排除nodemanager。可以是文件名的完整路经名,文件每一行是一台结点机器的IP或hostname。
默认值:空
我的设置:空
yarn.scheduler.minimum-allocation-mb
yarn.scheduler.maximum-allocation-mb
作用:每个容器向ResourceManager可申请的最小/最大内存,单位MB。
默认值:1024/8192
我的设置:随需要调整。
mapred-site.xml
mapreduce.map.memory.mb
作用:每个mapper申请的内存大小,单位MB
默认值:-1
我的设置:随需要调整。
mapreduce.map.java.opts
作用:为运行JVM程序准备的。mapper的child jvm的最大堆大小,单位MB
默认值:?
我的设置:-Xmx1014M,随需要调整。
mapreduce.reduce.memory.mb
作用:每个reducer申请的内存大小,单位MB
默认值:-1
我的设置:随需要调整。
mapreduce.reduce.java.opts
作用:为运行JVM程序准备的。reducer的child jvm的最大堆大小,单位MB
默认值:?
我的设置:-Xmx2560M,随需要调整。
mapreduce.task.timeout
作用:mr任务超时时间,超时将被自动杀死。超时的定义:既不读input,又不写output,还不更新status string。单位毫秒,设置为0则disable此配置。
默认值:600000 (10分钟)
我的设置:默认。随需要调整。
mapreduce.map.maxattempts
mapreduce.reduce.maxattempts
作用:map和reduce任务的最多尝试次数。
注意任务尝试(task attempt)被中止(killed)与任务失败(task failure)不同,前者不计入。
默认值:4
我的设置:默认。随需要调整。
mapreduce.map.failures.maxpercent
mapreduce.reduce.failures.maxpercent
作用:map和reduce任务的最多失败百分比。
默认值:?
我的设置:5。随需要调整。
mapreduce.task.io.sort.mb
作用:shuffle阶段排序时,mapper任务输出的内存缓冲区总大小,单位MB。
默认值:100
我的设置:默认。随需要调整。
mapreduce.map.sort.spill.percent
作用:shuffle阶段排序时,将内容写进磁盘的缓冲区阈值百分比。
默认值:0.80
我的设置:默认。随需要调整。
mapreduce.map.combine.minspills
作用:shuffle阶段排序时,运行combiner所需要的最少spill files数。
默认值:0.80
我的设置:默认。随需要调整。
mapreduce.task.io.sort.factor
作用:shuffle阶段排序时,每次内存缓存溢出阈值,都会生成一个溢出文件(spill file)。多个spill file会被合并,此配置项控制reducer一次最多合并多少流。
默认值:10
我的设置:默认。随需要调整,建议适当提高。
mapreduce.reduce.shuffle.parallelcopies
作用:shuffle阶段排序时,reduce并行复制mapper输出的线程数。
默认值:5.
我的设置:默认。随需要调整。
hadoop配置项笔记 - yarn的更多相关文章
- Hadoop学习笔记—Yarn
目录 一些基本知识 ResourceManager 的恢复 Resource Manager的HA YARN Node Labels YARN Node Attributes Web Applicat ...
- hadoop配置项笔记 - hdfs
hadoop版本:3.1.1 core-site.xml dfs.namenode.rpc-address 作用:rpc地址.我在使用distcp时显式使用到了. 默认值:port是8020 我的设置 ...
- hadoop配置项笔记 - streaming
stream.map.input.ignoreKey 作用:是否忽略key,只传递值. 默认值:false 我的设置:按需要更改 stream.map.input.field.separator st ...
- Hadoop学习笔记—HDFS
目录 搭建安装 三个核心组件 安装 配置环境变量 配置各上述三组件守护进程的相关属性 启停 监控和性能 Hadoop Rack Awareness yarn的NodeManagers监控 命令 hdf ...
- Hadoop学习笔记—22.Hadoop2.x环境搭建与配置
自从2015年花了2个多月时间把Hadoop1.x的学习教程学习了一遍,对Hadoop这个神奇的小象有了一个初步的了解,还对每次学习的内容进行了总结,也形成了我的一个博文系列<Hadoop学习笔 ...
- Hadoop阅读笔记(一)——强大的MapReduce
前言:来园子已经有8个月了,当初入园凭着满腔热血和一脑门子冲动,给自己起了个响亮的旗号“大数据 小世界”,顿时有了种世界都是我的,世界都在我手中的赶脚.可是......时光飞逝,岁月如梭~~~随手一翻 ...
- Hadoop学习之YARN框架
转自:http://www.ibm.com/developerworks/cn/opensource/os-cn-hadoop-yarn/,非常感谢分享! 对于业界的大数据存储及分布式处理系统来说,H ...
- Hadoop读书笔记(四)HDFS体系结构
Hadoop读书笔记(一)Hadoop介绍:http://blog.csdn.net/caicongyang/article/details/39898629 Hadoop读书笔记(二)HDFS的sh ...
- Hadoop阅读笔记(七)——代理模式
关于Hadoop已经小记了六篇,<Hadoop实战>也已经翻完7章.仔细想想,这么好的一个框架,不能只是流于应用层面,跑跑数据排序.单表链接等,想得其精髓,还需深入内部. 按照<Ha ...
随机推荐
- nc_netcat命令
它可以打开TCP连接.发送UDP数据包.监听任意TCP和UDP端口,进行端口扫描,处理IPv4和IPv6 这个命令适用于写脚本 nc -z -w 10 ip port -z:指定NC只应扫描侦听守护 ...
- mysql 获取昨天数据 utc时间
# yzj邀请昨日数据 SELECT s.id, s.create_at, ch.id, ch.code AS channel, c.id , c.code AS custom, so.id, so. ...
- 实验吧MD5之守株待兔解题思路
解题链接 http://ctf5.shiyanbar.com/misc/keys/keys.php 解题思路 首先我们多打开几次解题链接,发现系统密钥大约在一秒钟左右变一次,所以联想到时间戳. 解题过 ...
- linux 消息队列
消息队列,这个可是鼎鼎大名,经常在某些地方看见大家那个膜拜,那个,嗯,那个... 那就给个完整的例子,大家欣赏就行,我一直认为不用那个,嗯@ 这个队列的最大作用就是进程间通信,你要非搞个持久化,那也行 ...
- jmeter压测mysql报can not be represented as java.sql.Timestame错误解决方法
JDBC Request 测试mysql时报以下问题? jmeter报错信息: 解决方法: 在数据库url后拼接上字符串?characterEncoding=utf8&zeroDateTim ...
- Leetcode: Sliding Window Median
Median is the middle value in an ordered integer list. If the size of the list is even, there is no ...
- PHP 面向对象之单例模式-有些类也需要计划生育
一个类只有一个实例对象 1.含义 作为对象的创建模式,单例模式确保某一个类只有一个实例,而且自行实例化并向整个系统全局的提供这个实例.它不会创建实例副本,而是会向单例类内部存储的实例返回一个引用. 2 ...
- Centos6.10 安装Python 2.7.16
部署一个程序, 系统环境:CentOS 6.10 64位 Python版本:2.7 1.升级下系统 yum install eple-release -y yum update -y 2.下载pyth ...
- Python实现图像直方图均衡化算法
title: "Python实现图像直方图均衡化算法" date: 2018-06-12T17:10:48+08:00 tags: [""] categorie ...
- python之堡垒机(第九天)
本节作业: 通过使用paramiko和sqlalchemy实现堡垒机功能 主要功能实现: 1.用户登录堡垒机后,无需知道密码或密钥可以SSH登录远端服务器: 2.用户对一个组内所有主机批量执行指定命令 ...