Hadoop伪分布式搭建

1.准备Linux环境

①开启网络,ifconfig指令查看ip

②修改主机名为自己名字(hadoop)

vim /etc/sysconfig/network

NETWORKING=yes

HOSTNAME=hadoop

③修改主机名和IP的映射关系

vim /etc/hosts

192.168.182.128 hadoop

④关闭防火墙

#查看防火墙状态

service iptables status

#关闭防火墙

service iptables stop

#关闭防火墙开机启动

chkconfig iptables off

⑤重启Linux

reboot

安装JDK

安装自己的JDK前,删除openJDK:

查看java安装版本:java -version

查看java安装包:rpm -qa|grep java

删除java安装包:rpm -e --nodeps 包名

2.安装JDK

①filezilla上传jdk到/opt

②解压jdk

cd /opt

tar -zxvf jdk-7u76-linux-x64.tar.gz

③将java添加到环境变量中

vim /etc/profile

#在文件最后添加

export JAVA_HOME=/opt/jdk1.7.0_76

export PATH=$PATH:$JAVA_HOME/bin

④刷新配置

source /etc/profile

⑤查看java的版本

java -version

安装hadoop

3.安装Hadoop

①filezilla上传hadoop安装包,配置文档(hadoop2.2.0伪分布式搭建.txt)

3.2解压hadoop安装包

	#解压

	tar -zxvf hadoop-2.2.0.tar.gz

3.3修改配置文件（5个） 路径:/opt/hadoop-2.2.0/etc/hadoop

	第一个：hadoop-env.sh

	#在27行修改

	export JAVA_HOME=/opt/jdk1.7.0_76

	第二个：core-site.xml

	<configuration>

		<!-- 指定HDFS老大（namenode）的通信地址 -->

		<property>

				<name>fs.defaultFS</name>

				<value>hdfs://localhost:9000</value>

		</property>

		<!-- 指定hadoop运行时产生文件的存储路径 -->

		<property>

				<name>hadoop.tmp.dir</name>

				<value>/opt/hadoop-2.2.0/tmp</value>

		</property>

	</configuration>

	第三个：hdfs-site.xml

	<configuration>

		<!-- 设置hdfs副本数量 -->

		<property>

				<name>dfs.replication</name>

				<value>1</value>

		</property>

	</configuration>

	第四个：mapred-site.xml.template 需要重命名： mv mapred-site.xml.template mapred-site.xml

	<configuration>

		<!-- 通知框架MR使用YARN -->

		<property>

				<name>mapreduce.framework.name</name>

				<value>yarn</value>

		</property>

	</configuration>

	第五个：yarn-site.xml

	<configuration>

		<!-- reducer取数据的方式是mapreduce_shuffle -->

		<property>

			<name>yarn.nodemanager.aux-services</name>

			<value>mapreduce_shuffle</value>

		</property>

	</configuration>

3.4将hadoop添加到环境变量

	vim /etc/profile

	export JAVA_HOME=/opt/jdk1.7.0_55

	export HADOOP_HOME=/opt/hadoop-2.2.0

	export PATH=$PATH:$JAVA_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

	source /etc/profile

3.5格式化HDFS（namenode）第一次使用时要格式化

	hadoop namenode -format

3.6启动hadoop

	先启动HDFS

	start-dfs.sh

	再启动YARN

	start-yarn.sh

3.7验证是否启动成功

	使用jps命令验证

	27408 NameNode

	28218 Jps

	27643 SecondaryNameNode

	28066 NodeManager

	27803 ResourceManager

	27512 DataNode

	http://localhost:50070  (HDFS管理界面)

	http://localhost:8088 （MR管理界面）

4.配置ssh免登陆

生成ssh免登陆密钥

cd ~，进入到我的home目录

cd .ssh/

ssh-keygen -t rsa （四个回车）

执行完这个命令后，会生成两个文件id_rsa（私钥）、id_rsa.pub（公钥）

将公钥拷贝到要免登陆的机器上

cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys

或

ssh-copy-id -i localhost

Hadoop安装部署的更多相关文章

记一次Hadoop安装部署过程
实验名称:Hadoop安装部署一.实验环境: 虚拟机数量:3个 (1个master,2个slave:slave01,slave02) 主节点master信息: 操作系统:CentOS7.5 软件包位 ...
zookeeper,hadoop安装部署其实与防火墙无关
网上查看了很多人关于hadoop,zookeeper的文章,大多都把关闭防火墙作为首要前提,个人觉得这大可不必. 首先你需要知道你部署的是什么东西,它需要哪些端口即可.把相关端口打开就可以了啊.然后把 ...
Hadoop安装-部署-测试
一:准备Linux环境[安装略] a.修改主机名 vim /etc/sysconfig/network NETWORKING= ...
Hadoop+Hbas完全分布式安装部署
Hadoop安装部署基本步骤: 1.安装jdk,配置环境变量. jdk可以去网上自行下载,环境变量如下: 编辑 vim /etc/profile 文件,添加如下内容: export JAVA_HO ...
安装部署Apache Hadoop (本地模式和伪分布式)
本节内容: Hadoop版本安装部署Hadoop 一.Hadoop版本 1. Hadoop版本种类目前Hadoop发行版非常多,有华为发行版.Intel发行版.Cloudera发行版(CDH)等, ...
hadoop 安装过程记录
1)首先配置好了四个linux虚拟机 root pwd:z****l*3 关闭了防火墙开通了 sshd服务开通了 ftp服务配置了 jdk 1.8 配置好了互信 (之前配置的过程忘了!--检查了 ...
CentOS 6.5 x64下Hadoop安装
Apache Hadoop安装部署模式单机(本地)模式(Standalone Mode) 伪分布模式(Pseudo-Distributed Mode) 完全分布模式(Fully Distribute ...
Hadoop2.7.3+Hbase-1.2.6+spark2.1.2完全分布式安装部署
https://www.cnblogs.com/lzxlfly/p/7221890.html 总的下载地址: http://mirror.bit.edu.cn/apache/ hadoop下 ...
hadoop入门（3）——hadoop2.0理论基础：安装部署方法
一.hadoop2.0安装部署流程 1.自动安装部署:Ambari.Minos(小米).Cloudera Manager(收费) 2.使用RPM包安装部署:Apache ...

随机推荐

ubuntu21.10搭建jenkins和gitlab自动化部署环境
镜像下载.域名解析.时间同步请点击阿里云开源镜像站前置环境: vmware pro 16 + ubuntu21.10 安装gitlab 搭建ssh远程打开终端 sudo apt-get insta ...
JSON.parse()和JSON.stringfy()区别
JSON.parse() 用于从一个json格式字符串解析出json类型的数据,如: 注意事项:json格式字符串必须是写在一排的,且括号外面用单引号,里面的每一个字符串用双引号 JSON.strin ...
kdump原理，是如何找到入口的
请解释下kdump原理,捕获内核是如何获取到生产内核的首地址的.
Linux安全加固手册
1 身份鉴别 1.1 密码安全策略操作系统和数据库系统管理用户身份鉴别信息应具有不易被冒用的特点,口令应有复杂度要求并定期更换. 设置有效的密码策略,防止攻击者破解出密码 ...
Colbalt Strike之CHM木马
一.命令执行(calc)木马生成 1.生成木马首先创建一个根目录,文件名为exp 在文件夹里创建两个目录和一个index.html文件在两个目录里分别创建txt文件或html文件 index.ht ...
volatile 变量和 atomic 变量有什么不同？
Volatile 变量可以确保先行关系,即写操作会发生在后续的读操作之前, 但它并不能保证原子性.例如用 volatile 修饰 count 变量那么 count++ 操作就不是原子性的. 而 A ...
SpringBoot bean映射yml中的属性举例
pom:导入配置文件处理器,配置文件进行绑定就会有提示 <dependency> <groupId>org.springframework.boot</groupId&g ...
CI_CD 简单了解
spring 事务实现方式有哪些？
Spring提供了编程式事务和声明式事务两种实现方式, 编程式事务允许用户在代码中精确定义事务的边界, 而声明式事务(基于AOP)有助于用户将操作与事务规则进行解耦. 简单地说,编程式事务侵入到了业务 ...
(转载)JSON对象使用变量作为键名
转载链接:https://blog.csdn.net/lihefei_coder/article/details/82499520 //第一种方式 var key = 'name'; var json ...

Hadoop安装部署

Hadoop伪分布式搭建

Hadoop安装部署的更多相关文章

随机推荐

热门专题