1. 主机规划

主机名称	IP地址	操作系统	部署软件	运行进程	备注
mini01	172.16.1.11【内网】 10.0.0.11 【外网】	CentOS 7.5	Jdk-8、zookeeper-3.4.5、Hadoop2.7.6、hbase-2.0.2、kafka_2.11-2.0.0、spark-2.4.0-hadoop2.7【主】	QuorumPeerMain、
mini02	172.16.1.12【内网】 10.0.0.12 【外网】	CentOS 7.5	Jdk-8、zookeeper-3.4.5、Hadoop2.7.6、hbase-2.0.2、kafka_2.11-2.0.0	QuorumPeerMain、
mini03	172.16.1.13【内网】 10.0.0.13 【外网】	CentOS 7.5	Jdk-8、zookeeper-3.4.5、Hadoop2.7.6、hbase-2.0.2、kafka_2.11-2.0.0、spark-2.4.0-hadoop2.7	QuorumPeerMain、
mini04	172.16.1.14【内网】 10.0.0.14 【外网】	CentOS 7.5	Jdk-8、zookeeper-3.4.5、Hadoop2.7.6、hbase-2.0.2、spark-2.4.0-hadoop2.7	QuorumPeerMain、
mini05	172.16.1.15【内网】 10.0.0.15 【外网】	CentOS 7.5	Jdk-8、zookeeper-3.4.5、Hadoop2.7.6、hbase-2.0.2、spark-2.4.0-hadoop2.7	QuorumPeerMain、

说明

该Spark集群安装，但是有一个很大的问题，那就是Master节点存在单点故障，要解决此问题，就要借助zookeeper，并且启动至少两个Master节点来实现高可靠。具体部署下节讲解。

2. 免密码登录

　　实现mini01到mini02、mini03、mini04、mini05通过秘钥免密码登录。

参见文章：Hadoop2.7.6_01_部署

3. Jdk【java8】

参见文章：Hadoop2.7.6_01_部署

4. Spark部署步骤

4.1. Spark安装

 [yun@mini01 software]$ pwd

 /app/software

 [yun@mini01 software]$ ll

 total

 -rw-r--r--   yun yun  Nov  : spark-2.4.-bin-hadoop2..tgz

 [yun@mini01 software]$ tar xf spark-2.4.-bin-hadoop2..tgz

 [yun@mini01 software]$ mv spark-2.4.-bin-hadoop2. /app/

 [yun@mini01 software]$ cd /app/

 [yun@mini01 ~]$ ln -s spark-2.4.-bin-hadoop2./ spark

 [yun@mini01 ~]$ ll -d spark-*

 drwxr-xr-x  yun yun  Oct  : spark-2.4.-bin-hadoop2.

 lrwxrwxrwx   yun yun   Nov  : spark -> spark-2.4.-bin-hadoop2./

4.2. 环境变量修改

　　根据规划，该环境变量的修改包括mini01、mini03、mini04、mini05。

 # 需要root权限去添加环境变量

 [root@mini01 ~]# tail /etc/profile

 ………………

 # spark环境变量

 export SPARK_HOME="/app/spark"

 export PATH=$SPARK_HOME/bin:$SPARK_HOME/sbin:$PATH

 [root@mini01 ~]# logout

 [yun@mini01 conf]$ source /etc/profile  # 重新加载该环境变量

4.3. 配置修改

 [yun@mini01 conf]$ pwd

 /app/spark/conf

 [yun@mini01 conf]$ cp -a spark-env.sh.template spark-env.sh

 [yun@mini01 conf]$ tail spark-env.sh  # 修改环境变量配置

 # Options for native BLAS, like Intel MKL, OpenBLAS, and so on.

 # You might get better performance to enable these options if using native BLAS (see SPARK-).

 # - MKL_NUM_THREADS=        Disable multi-threading of Intel MKL

 # - OPENBLAS_NUM_THREADS=   Disable multi-threading of OpenBLAS

 # 添加配置如下

 # 配置JAVA_HOME

 export JAVA_HOME=/app/jdk

 # 设置Master的主机名

 export SPARK_MASTER_IP=mini01

 # 每一个Worker最多可以使用的内存，我的虚拟机就2g

 # 真实服务器如果有128G，你可以设置为100G

 # 所以这里设置为1024m或1g

 export SPARK_WORKER_MEMORY=1024m

 # 每一个Worker最多可以使用的cpu core的个数，我虚拟机就一个...

 # 真实服务器如果有32个，你可以设置为32个

 export SPARK_WORKER_CORES=

 # 提交Application的端口，默认就是这个，万一要改呢，改这里

 export SPARK_MASTER_PORT=

 [yun@mini01 conf]$ pwd

 /app/spark/conf

 [yun@mini01 conf]$ cp -a slaves.template slaves

 [yun@mini01 conf]$ tail slaves  # 修改slaves 配置

 # distributed under the License is distributed on an "AS IS" BASIS,

 # WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.

 # See the License for the specific language governing permissions and

 # limitations under the License.

 #

 # A Spark Worker will be started on each of the machines listed below.

 mini03

 mini04

 mini05

4.4. 分发到其他机器

　　分发到mini03、mini04和mini05

 [yun@mini01 ~]$ scp -pr spark-2.4.-bin-hadoop2./ yun@mini03:/app  # 拷贝到mini03

 [yun@mini01 ~]$ scp -pr spark-2.4.-bin-hadoop2./ yun@mini04:/app  # 拷贝到mini04

 [yun@mini01 ~]$ scp -pr spark-2.4.-bin-hadoop2./ yun@mini05:/app  # 拷贝到mini05

在mini03、mini04和mini05上操作

 [yun@mini04 ~]$ pwd

 /app

 [yun@mini04 ~]$ ll -d spark-2.4.-bin-hadoop2.

 drwxr-xr-x  yun yun  Oct  : spark-2.4.-bin-hadoop2.

 [yun@mini04 ~]$ ln -s spark-2.4.-bin-hadoop2./ spark

 [yun@mini04 ~]$ ll -d spark-*

 drwxr-xr-x  yun yun  Oct  : spark-2.4.-bin-hadoop2.

 lrwxrwxrwx   yun yun   Nov  : spark -> spark-2.4.-bin-hadoop2./

4.5. 启动spark

在mini01上操作

 [yun@mini01 sbin]$ pwd

 /app/spark/sbin

 [yun@mini01 sbin]$ ./start-all.sh  # 关闭使用 stop-all.sh 脚本

 starting org.apache.spark.deploy.master.Master, logging to /app/spark/logs/spark-yun-org.apache.spark.deploy.master.Master--mini01.out

 mini03: starting org.apache.spark.deploy.worker.Worker, logging to /app/spark/logs/spark-yun-org.apache.spark.deploy.worker.Worker--mini03.out

 mini05: starting org.apache.spark.deploy.worker.Worker, logging to /app/spark/logs/spark-yun-org.apache.spark.deploy.worker.Worker--mini05.out

 mini04: starting org.apache.spark.deploy.worker.Worker, logging to /app/spark/logs/spark-yun-org.apache.spark.deploy.worker.Worker--mini04.out

 [yun@mini01 ~]$

 [yun@mini01 ~]$ jps  # 查看进程状态

  Master

  Jps

mini03进程查看

 [yun@mini03 ~]$ jps

  Worker

  Jps

mini04进程查看

 [yun@mini04 ~]$ jps

  Jps

  Worker

mini05进程查看

 [yun@mini05 ~]$ jps

  Worker

  Jps

4.6. 浏览器访问

 http://mini01:8080/

spark-2.4.0-hadoop2.7-安装部署的更多相关文章

hadoop入门（3）——hadoop2.0理论基础：安装部署方法
一.hadoop2.0安装部署流程 1.自动安装部署:Ambari.Minos(小米).Cloudera Manager(收费) 2.使用RPM包安装部署:Apache ...
spark编译安装 spark 2.1.0 hadoop2.6.0-cdh5.7.0
1.准备: centos 6.5 jdk 1.7 Java SE安装包下载地址:http://www.oracle.com/technetwork/java/javase/downloads/java ...
spark 1.1.0 单机与yarn部署
环境:ubuntu 14.04, jdk 1.6, scala 2.11.4, spark 1.1.0, hadoop 2.5.1 一 spark 单机模式部分操作参考:http://www.cnb ...
spark 2.1.0 集群安装
jdk安装 http://www.cnblogs.com/xiaojf/p/6568426.html scala2.11 安装 http://www.cnblogs.com/xiaojf/p/6568 ...
jumpserverv0.5.0 基于 CentOS7安装部署
基于 CentOS 7 一步一步安装 Jumpserver 0.5.0 环境系统: CentOS 7 IP: 192.168.244.144 关闭 selinux和防火墙 # CentOS 7 $ ...
ElasticSearch 5.0.0 集群安装部署文档
1. 搭建环境 3台物理机操作系统 centos7 es1 192.168.31.141 4g内存 2核 es2 192.168.31.142 4g内存 2核 es3 ...
Apache Mesos1.0.1 编译安装部署教程(ubuntu)
参考资料官方文档:http://mesos.apache.org/documentation 中文翻译:http://mesos.mydoc.io/ GitHub:https://github.co ...
Spark（一）-- Standalone HA的部署
首先交代一下集群的规模和配置集群有六台机器,均是VM虚拟机,每台256M的内存(原谅楼主物理机硬件不太给力) 主机名分别是cloud1~cloud6 每台机器上都装有jdk6,和hadoop-2.2 ...
Redis （一）Redis简介、安装部署
Redis是一个开源的,先进的 key-value 存储可用于构建高性能,可扩展的 Web 应用程序的解决方案. 既然是key-value,对于Java开发来说更熟悉的是Map集合.那就有问题了,有M ...
（转）实验文档1：跟我一步步安装部署kubernetes集群
实验环境基础架构主机名角色 ip HDSS7-11.host.com k8s代理节点1 10.4.7.11 HDSS7-12.host.com k8s代理节点2 10.4.7.12 HDSS7- ...

随机推荐

在.NET中使用Redis
dll文件 namespace RedisDemo { public partial class RedisPage : System.Web.UI.Page { protected void Pag ...
log4cplus使用(二)-自定义日志等级
log4cplus支持用户自定义日志等级,操作也比较简单,使用之前贴如下宏定义 #define LOG4CPLUS_MACRO_CREASH_LOG_LEVEL(pred) LOG4CPLUS_UNL ...
redis 系列10 字符串对象
一. 字符串对象编码 Redis中字符串可以存储3种类型,分别是字节串(byte string).整数.浮点数.在上章节中讲到字符串对象的编码可以是int, raw,embstr. 如果一个字符串对象 ...
SpringBoot入门教程(七)整合themeleaf+bootstrap
Thymeleaf是用于Web和独立环境的现代服务器端Java模板引擎.Thymeleaf的主要目标是将优雅的自然模板带到您的开发工作流程中—HTML能够在浏览器中正确显示,并且可以作为静态原型,从而 ...
ADO.NET五大对象详解
Connection 连接对象用于对数据库的连接操作.传入的参数为连接字符串. Commamd 命令对象用于执行对数据库的操作 ,传入的参数可以为连接字符串或存储过程,也必须传入连接对象的实例. ...
PHP自动加载机制
类的载入共经历了三个阶段第一阶段是面向过程式的做法,整个项目里到处都是include或require. 问题:难看,不易维护. . 第二阶段是魔术方法__autoload,当new一个类的时候,如果 ...
linux 防火墙详细介绍
1.其实匹配扩展中,还有需要加-m引用模块的显示扩展,默认是隐含扩展,不要使用 -m状态检测的包过滤-m state --state {NEW,ESTATBLISHED,INVALID,R ...
Thread之九：stop
搞过Java线程的人都知道,stop这个方法是臭名昭著了,早就被弃用了,但是现在任然有很多钟情与他的人,永远都放不下他,因为从他的字面意思上我们可以知道他貌似可以停止一个线程,这个需求是每个搞线程开发 ...
SpringBoot基础系列-SpringBoot配置
原创作品,可以转载,但是请标注出处地址:https://www.cnblogs.com/V1haoge/p/9990680.html SpringBoot基础系列-SpringBoot配置概述属性 ...
Spring Cloud Alibaba Nacos 入门
概览阿里巴巴在2018年7月份发布Nacos, Nacos是一个更易于构建云原生应用的动态服务发现.配置管理和服务管理平台.并表示在6-8个月完成到生产可用的0.8版本,目前版本是0.9版本. Na ...

spark-2.4.0-hadoop2.7-安装部署