DataNode的工作机制

一个数据块在DataNode以文件的形式在磁盘上保存，分为两个文件，一个是数据本身，

一个是元数据信息（包括数据的长度，校验和，时间戳）

1.DataNode启动后，向NameNode进行注册

2.NameNode返回注册成功

3.以后按照每周期（1小时）上报所有块信息

4.心跳每3秒一次，心跳返回带有NameNode给DataNode的命令

5.超过10分钟+timestamp（可配置）没有接收到心跳包，那么认定该接点不可用

掉线时限参数设置

datanode 进程死亡或者网络故障造成 datanode 无法与 namenode 通信，namenode 不会立

即把该节点判定为死亡，要经过一段时间，这段时间暂称作超时时长。HDFS 默认的超时时

长为 10 分钟+30 秒。如果定义超时时间为 timeout，则超时时长的计算公式为：

timeout = 2 * dfs.namenode.heartbeat.recheck-interval + 10 * dfs.heartbeat.interval。

而默认的 dfs.namenode.heartbeat.recheck-interval 大小为 5 分钟，dfs.heartbeat.interval 默

认为 3 秒。

需要注意的是 hdfs-site.xml 配置文件中的 heartbeat.recheck.interval 的单位为毫秒，

dfs.heartbeat.interval 的单位为秒。

	<property>

		<name>dfs.namenode.heartbeat.recheck-interval</name>

		<value>300000</value>

	</property>

	<property>

		<name> dfs.heartbeat.interval </name>

		<value>3</value>

	</property>

服役新数据节点

在原有集群基础上动态添加新的数据节点

步骤：

	（1）在 namenode 的/opt/module/hadoop-2.7.2/etc/hadoop 目录下创建 dfs.hosts 文件

		$ pwd

		/opt/module/hadoop-2.7.2/etc/hadoop

		$ touch dfs.hosts

		$ vi dfs.hosts

		添加主机名称（包含新服役的节点）

	（2）在 namenode 的 hdfs-site.xml 配置文件中增加 dfs.hosts 属性

		<property>

			<name>dfs.hosts</name>

			<value>/opt/module/hadoop-2.7.2/etc/hadoop/dfs.hosts</value>

		</property>

	（3）刷新 namenode

		$ hdfs dfsadmin -refreshNodes

		Refresh nodes successful

	（4）更新 resourcemanager 节点

		$ yarn rmadmin -refreshNodes

		19/03/24 14:17:11 INFO client.RMProxy: Connecting to ResourceManager athostname/ip:8033

	（5）在 namenode 的 slaves 文件中增加新主机名称（不需要分发）

	（6）单独命令启动新的数据节点和节点管理器

		$ sbin/hadoop-daemon.sh start datanode

		$ sbin/yarn-daemon.sh start nodemanager

	（7）在 web 浏览器上检查是否 ok

如果数据不均衡，可以用命令实现集群的再平衡

		102：$ ./start-balancer.sh

退役旧节点

步骤：

	（1）在 namenode 的/opt/module/hadoop-2.7.2/etc/hadoop 目录下创建 dfs.hosts.exclude 文件

		$ pwd

		/opt/module/hadoop-2.7.2/etc/hadoop

		$ touch dfs.hosts.exclude

		$ vi dfs.hosts.exclude

		添加主机名称（要退役的节点）	

	（2）在 namenode 的 hdfs-site.xml 配置文件中增加 dfs.hosts.exclude 属性

		<property>

			<name>dfs.hosts.exclude</name>

			<value>/opt/module/hadoop-2.7.2/etc/hadoop/dfs.hosts.exclude</value>

		</property>

	（3）刷新 namenode、刷新 resourcemanager

		$ hdfs dfsadmin -refreshNodes

		Refresh nodes successful

		$ yarn rmadmin -refreshNodes

	（4）检查 web 浏览器，退役节点的状态为 decommission in progress（退役中），说明数据节点正在复制块到其他节点

	（5）等待退役节点状态为 decommissioned（所有块已经复制完成），停止该节点及节点资源管理器。

		注意：如果副本数是 3，服役的节点小于等于 3，是不能退役成功的，需要修改副本数后才能退役。

如果失败：

		$ sbin/hadoop-daemon.sh stop datanode

		$ sbin/yarn-daemon.sh stop nodemanager

6）从 include 文件中删除退役节点，再运行刷新节点的命令

	（1）从 namenode 的 dfs.hosts 文件中删除退役节点

	（2）刷新 namenode，刷新 resourcemanager

7）从 namenode 的 slave 文件中删除退役节点 hadoop105

8）如果数据不均衡，可以用命令实现集群的再平衡

DataNode多目录配置

DataNode也可以配置成多个目录，每个目录存储的数据不一样。即：数据不是副本

hdfs-site.xml：

	<property>

		<name>dfs.datanode.data.dir</name>

		<value>file:///${hadoop.tmp.dir}/dfs/data1,file:///${hadoop.tmp.dir}/dfs/data2</value>

	</property>

本博客仅为博主学习总结，感谢各大网络平台的资料。蟹蟹!!

DataNode的工作机制的更多相关文章

Hadoop_10_HDFS 的 DataNode工作机制
1.DataNode的工作机制: 1.DataNode工作职责:存储管理用户的文件块数据定期向namenode汇报自身所持有的block信息(通过心跳信息上报) (这点很重要,因为,当集群中发生某 ...
Hadoop的namenode的管理机制，工作机制和datanode的工作原理
HDFS前言: 1) 设计思想分而治之:将大文件.大批量文件,分布式存放在大量服务器上,以便于采取分而治之的方式对海量数据进行运算分析: 2)在大数据系统中作用: 为各类分布式运算框架(如:mapr ...
hdfs namenode/datanode工作机制
一. namenode工作机制 1. 客户端上传文件时,namenode先检查有没有同名的文件,如果有,则直接返回错误信息.如果没有,则根据要上传文件的大小以及block的大小,算出需要分成几个blo ...
DataNode 工作机制
版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明.本文链接:https://blog.csdn.net/qq_35641192/article/d ...
HDFS中DataNode工作机制
1.DataNode工作机制 1)一个数据块在datanode上以文件形式存储在磁盘上,包括两个文件,一个是数据本身,一个是元数据(包括数据块的长度,块数据的校验和,以及时间戳). 2)DataNod ...
Hadoop框架：DataNode工作机制详解
本文源码:GitHub·点这里 || GitEE·点这里一.工作机制 1.基础描述 DataNode上数据块以文件形式存储在磁盘上,包括两个文件,一个是数据本身,一个是数据块元数据包括长度.校验.时 ...
Hadoop（五）—— HDFS NameNode、DataNode工作机制
一.NN与2NN工作机制 NameNode(NN) 1.当HDFS启动时,会加载日志(edits)和镜像文件(fsImage)到内存中. 2-4.当元数据的增删改查请求进来时,NameNode会先将操 ...
云计算分布式大数据Hadoop实战高手之路第七讲Hadoop图文训练课程：通过HDFS的心跳来测试replication具体的工作机制和流程
这一讲主要深入使用HDFS命令行工具操作Hadoop分布式集群,主要是通过实验的配置hdfs-site.xml文件的心跳来测试replication具体的工作和流程. 通过HDFS的心跳来测试repl ...
1 weekend110的NN元数据管理机制 + NN工作机制 + DN工作原理
第一天的笔记,是伪分布hadoop集群搭建, 后面是hadoop Ha的分布式集群搭建第一天,是HDFS的shell操作 NN工作机制里面是二进制 DN工作原理上传完了之后,在hdfs的虚拟路径 ...

随机推荐

C++的类型转换：static_cast、dynamic_cast、reinterpret_cast和const_cast（dynamic_cast还支持交叉转换，const_cast将一个类的const、volatile以及__unaligned属性去掉）
在C++中,存在类型转换,通常意味着存在缺陷(并非绝对).所以,对于类型转换,有如下几个原则:(1)尽量避免类型转换,包括隐式的类型转换(2)如果需要类型转换,尽量使用显式的类型转换,在编译期间转换( ...
一些Windows API导致的Crash以及使用问题总结（API的AV失败，可以用try catch捕捉后处理）
RegQueryValueEx gethostbyname/getaddrinfo _localtime64 FindFirstFile/FindNextFile VerQueryValue Crea ...
联想笔记本进入不了BIOS的解决方法
当计算机遇到问题时,很多情况下需要进入BIOS进行解决.但很多新出的联想笔记本电脑在开机时,无论怎么疯狂的按F2,Fn+F2,F12或者Del,都无法进入BIOS,十分气人. 这种现象出现的原因是联想 ...
hgoi#20190628
更好的阅读体验来我的博客观看 T1-打印收费 CZYZ 校园内有一家打印店,收费有着奇葩的规则,对于打印的量不同的情况会收取不同的费用.例如打印少于 100 张的时候,收取 20 分每张,但是打印不 ...
.NET开发框架(三)-高可用服务器端设计
我们对框架功能作了简述,演示视频请点击这里查看 ,若需要查看更多此框架的技术文章,请关注.NET框架学苑公众号! 本章节,我们专门讲解一下,如何在Window服务器下,设计高可用的框架. 我们的框架 ...
Azkaban学习之路（四）—— Azkaban Flow 2.0的使用
一.Flow 2.0 简介 1.1 Flow 2.0 的产生 Azkaban 目前同时支持 Flow 1.0 和 Flow2.0 ,但是官方文档上更推荐使用Flow 2.0,因为Flow 1.0会在将 ...
针对Linux 文件完整性监控的实现
针对Linux 文件完整性监控的实现摘要计算机和互联网是20世纪以来最伟大的发明之一,随着计算机技术的不断发展,人们的生活方式发生了巨大的变化.计算机和互联网的发展给人们的生产生活带来了极大的便利 ...
centos安装netcat TCP UDP测试工具简称 nc，安全界叫它瑞士军刀
centos安装netcat 今天安装swoole后,测试UDP服务需要用到netcat,然而百度了很多安装方法,并没有一个好用的.几经尝试,终于安装成功,现在就分享给大家,以供参考. 配置环境:ce ...
Python开发【第六篇】：面向对象
内容概要面向对象和面向过程面向对象三大特征面向对象的成员类与类之间的关系约束 type.issubclass.isinstance self.super.MRO 1. 面向对象和面向过程 0 ...
python爬虫的一个常见简单js反爬
python爬虫的一个常见简单js反爬我们在写爬虫是遇到最多的应该就是js反爬了,今天分享一个比较常见的js反爬,这个我已经在多个网站上见到过了. 我把js反爬分为参数由js加密生成和js生成coo ...

DataNode的工作机制

DataNode的工作机制

掉线时限参数设置

服役新数据节点

退役旧节点

DataNode多目录配置

DataNode的工作机制的更多相关文章

随机推荐

热门专题