Hadoop2.2集群安装配置-Spark集群安装部署

配置安装Hadoop2.2.0 部署spark 1.0的流程

一、环境描写叙述

本实验在一台Windows7-64下安装Vmware。在Vmware里安装两虚拟机分别例如以下

主机名spark1（192.168.232.147），RHEL6.2-64 操作系统，usernameRoot

从机名spark2（192.168.232.152）。RHEL6.2-64 操作系统，usernameRoot

二、环境准备

1、防火墙禁用。SSH服务设置为开机启动。并关闭SELINUX

2、改动hosts文件

3、配置SSH无password登录

4、准备安装软件包

5、JDK1.7安装及配置

以上操作比較简单。在此就无需赘述。

三. Hadoop2.2集群安装配置

1、创建安装文件夹（在spark2上同做）

mkdir -p /root/install/hadoop

mkdir -p /root/install/hadoop/hdfs

mkdir -p /root/install/hadoop/tmp

mkdir -p /root/install/hadoop/mapred

mkdir -p /root/install/hadoop/hdfs/name

mkdir -p /root/install/hadoop/hdfs/data

mkdir -p /root/install/hadoop/mapred/local

mkdir -p /root/install/hadoop/mapred/system

2、把文件hadoop-2.2.0.x86_64.tar.gz上传到/root/install文件夹下，并解压

3、配置Hadoop环境变量

export HADOOP_HOME=/root/install/hadoop-2.2.0

export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop

export YARN_CONF_DIR=$HADOOP_HOME/etc/hadoop

export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH

4、配置Hadoop

（1）向配置hadoop-env.sh文件加入

export JAVA_HOME=/root/install/jdk1.7.0_21

（2）向配置yarn-env.sh文件加入

export JAVA_HOME=/root/install/jdk1.7.0_21

（3）配置core-site.xml

<configuration>

        <property>

                <name>fs.defaultFS</name>

                <value>hdfs://spark1:9000</value>

        </property>

        <property>

                <name>hadoop.tmp.dir</name>

                <value>/root/install/hadoop/tmp</value>

        </property>

</configuration>

（3）配置hdfs-site.xml

<configuration>

        <property>

                <name>dfs.name.dir</name>

                <value>/root/install/hadoop/hdfs/name</value>

        </property>

        <property>

                <name>dfs.data.dir</name>

                <value>/root/install/hadoop/hdfs/data</value>

        </property>

        <property>

                <name>dfs.replication</name>

                <value>3</value>

        </property>

</configuration>

（4）配置mapred-site.xml

<configuration>

        <property>

                <name>mapreduce.cluster.local.dir</name>

                <value>/root/install/hadoop/mapred/local</value>

        </property>

        <property>

                <name>mapreduce.cluster.system.dir</name>

                <value>/root/install/hadoop/mapred/system</value>

        </property>

        <property>

                <name>mapreduce.framework.name</name>

                <value>yarn</value>

        </property>

        <property>

                <name>mapreduce.jobhistory.address</name>

                <value>spark1:10020</value>

        </property>

        <property>

                <name>mapreduce.jobhistory.webapp.address</name>

                <value>spark1:19888</value>

        </property>

        <property>

                 <name>mapred.child.java.opts</name>

                 <value>-Djava.awt.headless=true</value>

        </property>

        <!-- add headless to default -Xmx1024m -->

        <property>

                 <name>yarn.app.mapreduce.am.command-opts</name>

                 <value>-Djava.awt.headless=true -Xmx1024m</value>

        </property>

        <property>

                 <name>yarn.app.mapreduce.am.admin-command-opts</name>

                 <value>-Djava.awt.headless=true</value>

         </property>

</configuration>

（5）配置masters

把localhost改动为spark1

（6）配置slaves

把localhost改动为spark1,spark2，这两个分别各一行

（7）配置好之后将整个安装文件夹复制到spark2的/root/install文件夹下

（8）编写一个脚本，方便改动配置文件时好同步到其它机器

[root@spark1 install]# cat dispatchcfg.sh

#!/bin/bash

for target in spark2

do

    scp -r $HADOOP_CONF_DIR $target:/root/install/hadoop-2.2.0/etc

done

（9）格式化Hadoop的Namenode：hadoop namenode -format

5.Hadoop集群启动

（1）start-all.sh

（2）查看相关进程（jps）

6 Hadoop測试

（1）创建一个文件夹/input。并把数据文件上传到文件夹下

hadoop fs -mkdir /input

hadoop fs -put /etc/group /input

（2）执行wordcount

hadoop jar hadoop-mapreduce-examples-2.2.0.jar wordcount /input /output

四、安装部署spark1.0

（1）解压spark-1.0.0-bin-2.2.0.tgz

（2）在文件conf/spark-env.sh加入

export JAVA_HOME=/root/install/jdk1.7.0_21

export SPARK_MASTER_IP=spark1

export SPARK_MASTER_PORT=7077

export SPARK_WORKER_CORES=1

export SPARK_WORKER_INSTANCES=1

export SPARK_WORKER_MEMORY=1g

（3）启动spark集群：sbin/start-all.sh，并查看相关进程

（4）查看执行效果

（5）执行 bin/spark-shell --executor-memory 1g --driver-memory 1g --master spark://spark1:7077

Hadoop2.2集群安装配置-Spark集群安装部署的更多相关文章

安装配置Spark集群
首先准备3台电脑或虚拟机,分别是Master,Worker1,Worker2,安装操作系统(本文中使用CentOS7). 1.配置集群,以下步骤在Master机器上执行 1.1.关闭防火墙:syste ...
Linux中安装配置spark集群
一. Spark简介 Spark是一个通用的并行计算框架,由UCBerkeley的AMP实验室开发.Spark基于map reduce 算法模式实现的分布式计算,拥有Hadoop MapReduce所 ...
配置spark集群
配置spark集群 1.配置spark-env.sh [/soft/spark/conf/spark-env.sh] ... export JAVA_HOME=/soft/jdk 2.配置slaves ...
Windows32或64位下载安装配置Spark
[学习笔记] Windows 32或64位下载安装配置Spark:1)下载地址:http://spark.apache.org/downloads.html 马克-to-win @ 马克java社区: ...
从subversion开始(svn安装配置全过程（+全套安装文件与配置文件）)…..
从subversion开始(svn安装配置全过程(+全套安装文件与配置文件))-.. 博客分类: 工具使用 SVNsubversion配置管理Apache应用服务器 </div> 花了一 ...
hadoop 集群搭建配置 spark yarn 对效率的提升永无止境
[手动验证:任意2个节点间是否实现双向 ssh免密登录] 弄懂通信原理和集群的容错性任意2个节点间实现双向 ssh免密登录,默认在~目录下 [实现上步后,在其中任一节点安装\配置hadoop后,可 ...
linux上配置spark集群
环境: linux spark1.6.0 hadoop2.2.0 一.安装scala(每台机器) 1.下载scala-2.11.0.tgz 放在目录: /opt下,tar -zxvf scal ...
hadoop 集群搭建配置 spark yarn 对效率的提升永无止境 Hadoop Volume 配置
[手动验证:任意2个节点间是否实现双向 ssh免密登录] 弄懂通信原理和集群的容错性任意2个节点间实现双向 ssh免密登录,默认在~目录下 [实现上步后,在其中任一节点安装\配置hadoop后,可 ...
hadoop集群环境搭建之安装配置hadoop集群
在安装hadoop集群之前,需要先进行zookeeper的安装,请参照hadoop集群环境搭建之zookeeper集群的安装部署 1 将hadoop安装包解压到 /itcast/ (如果没有这个目录 ...

随机推荐

HDU-2087 剪花布条字符串问题 KMP算法查匹配子串
题目链接:https://cn.vjudge.net/problem/HDU-2087 题意中文题咯一块花布条,里面有些图案,另有一块直接可用的小饰条,里面也有一些图案.对于给定的花布条和小饰条, ...
紫书习题8-18 UVa 11536 （扫描法）
这道题貌似可以用滑动窗口或者单调栈做, 但是我都没有用到. 这道题要求连续子序列中和乘上最小值最大, 那么我们就可以求出每一个元素, 以它为最小值的的最大区间的值, 然后取max就ok了.那么怎么求呢 ...
Hadoop的datanode超时时间设置
datanode进程死亡或者网络故障造成datanode无法与namenode通信, namenode不会立即把该节点判定为死亡,要经过一段时间,这段时间暂称作超时时长. HDFS默认的超时时长为10 ...
【BZOJ 1218】 [HNOI2003]激光炸弹
[链接] 我是链接,点我呀:) [题意] 在这里输入题意 [题解] 一开始以为可以炸多次. 然后发现是一次. 那么久直接做个前缀和就好了枚举正方形的左上角. 然后刚好和网格对齐的话. 肯定没有放在( ...
maven的setting设置
maven的setting设置,settings.xml文件,多写了几个仓库的地址: <?xml version="1.0" encoding="UTF-8&quo ...
Python 入门学习 -----变量及基础类型(元组，列表，字典，集合)
Python的变量和数据类型 1 .python的变量是不须要事先定义数据类型的.能够动态的改变 2. Python其中一切皆对象,变量也是一个对象,有自己的属性和方法我们能够通过来查看变量的类型 ...
JBOSS部署项目之后，无法通过IP地址訪问，仅仅能通过localhost或者127.0.0.1訪问
这几天入职到了一家新的公司,然后第一天就開始搭建各种环境.由于原先一直用的是Tomcat容器,然后也是第一次接触JBOSS容器,搭建完之后,在MyEclipse中启动了JBOSS容器,然后想在浏览器中 ...
R语言适配问题集锦
画图时的中文乱码问题我这是Mac Yousemite 10.10.5,在两个地方遇到了中文乱码 1.使用wordcloud包绘制中文标签云时. library(wordcloud) mydata & ...
【递推DP】POJ1163The Triangle
题目链接:http://poj.org/problem?id=1163 事实上这个题目有非常多解法,可是我们能够看下这个用一位数组的高效动规解法,这个我上课时老师讲的,非常不错. 先保存最后一行4 5 ...
10gR2 rac怎样重跑root.sh ？
原文博客链接地址:10gR2 rac怎样重跑root.sh ? 前几天遇到一客户的10205 rac,出现LMD进程IPC SEND TIMEOUT问题. 准备深入研究下Oracle RAC 的LMO ...

Hadoop2.2集群安装配置-Spark集群安装部署

Hadoop2.2集群安装配置-Spark集群安装部署的更多相关文章

随机推荐

热门专题