scala+hadoop+spark环境搭建

一、JDK环境构建

在指定用户的根目录下编辑.bashrc文件,添加如下部分：

# .bashrc

# Source global definitions

  if [ -f /etc/bashrc ]; then

         . /etc/bashrc

  fi

# User specific aliases and functions

JAVA_HOME=/data01/java/jdk1.8.0_121

PATH=$JAVA_HOME/bin:$PATH
export PATH JAVA_HOME

运行source .bashrc命令让环境变量生效

二、Scala环境构建

从http://www.scala-lang.org/download/2.10.4.html上下载Scala正确版本进行安装，本文以scala-2.12.2.tgz版本为例进行说明：

编辑.bashrc文件，设置scala环境变量

# .bashrc

# Source global definitions

  if [ -f /etc/bashrc ]; then

         . /etc/bashrc

  fi

# User specific aliases and functions

JAVA_HOME=/data01/java/jdk1.8.0_121

PATH=$JAVA_HOME/bin:$PATH

#scala variables

SCALA_HOME=/data01/spark/scala-2.12.2

PATH=$PATH:$SCALA_HOME/bin

export PATH JAVA_HOME
export SCALA_HOME PATH

我们还可以直接进入scala的环境进行测试,具体操作如下：

三、Hadoop环境构建

Hadoop安装包可以通过搜索hadoop-2.7.3.tar.gz来查找对应的安装包，

单机版hadoop安装方式请参见：http://www.zhongtiancai.com/post-143.html

伪分布模式安装方式请参见：http://www.jianshu.com/p/1e5ba77eb471和http://blog.csdn.net/zhu_xun/article/details/42077311

# .bashrc

# Source global definitions

  if [ -f /etc/bashrc ]; then

         . /etc/bashrc

  fi

# User specific aliases and functions

JAVA_HOME=/data01/java/jdk1.8.0_121

PATH=$JAVA_HOME/bin:$PATH

#scala variables

SCALA_HOME=/data01/spark/scala-2.12.2

PATH=$PATH:$SCALA_HOME/bin

export PATH JAVA_HOME

export SCALA_HOME PATH

#Hadoop Env

export HADOOP_HOME=/data01/spark/hadoop-2.7.3

export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

export HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_HOME/lib/native

export HADOOP_OPTS="-Djava.library.path=$HADOOP_HOME/lib"

http://IP:8099 Hadoop集群管理界面

http://IP:50070 HDFS管理界面

四、Spark环境构建

修改配置文件vi bashrc，最后一行添加以下代码

export SPARK_HOME=/home/spark

export PATH=$PATH:$SPARK_HOME/bin

　运行source bashrc使文件立即生效

运行spark-shell 命令，即可启动spark单机模式.

spark-shell启动时会出现太多的info信息，可以通过修改conf下面的log4j.properties.template=>log4j.properties，然后将其中的log.rootCategory=WARN,console修改成warn，世界也就清净了.

配置spark-env.sh，进入spark/conf

#以下添加在末尾

export  SPARK_MASTER_IP=192.168.232.130

export  SPARK_LOCAL_IP=192.168.232.130

注意：192.168.232.130为本机的ip

运行spark/sbin/start-all.sh 命令，即可启动伪分布式模式;

运行spark/sbin/stop-all.sh 命令，即可停止运行

另：spark集群的web端口默认为8080,安装成功后可以通过检查WebUI：http://IP:8080

如果需要修改Spark的默认端口号，那么可以将sbin/start-master.sh中的SPARK_MASTER_WEBUI_PORT修改为任意端口号

if [ "$SPARK_MASTER_WEBUI_PORT" = "" ]; then

   SPARK_MASTER_WEBUI_PORT=8888

fi

测试Spark是否安装成功：可以通过spark/bin/run-example org.apache.spark.examples.SparkPi来检测

Pi is roughly 3.14716

spark的安装可以参考：http://www.cnblogs.com/ivictor/p/5135792.html

scala+hadoop+spark环境搭建的更多相关文章

大数据学习系列之六 ----- Hadoop+Spark环境搭建
引言在上一篇中大数据学习系列之五 ----- Hive整合HBase图文详解 : http://www.panchengming.com/2017/12/18/pancm62/ 中使用Hive整合 ...
Hadoop SPARK 环境搭建
http://www.linuxidc.com/Linux/2015-02/113486.htm http://www.cnblogs.com/lijingchn/p/5574476.html htt ...
Scala进阶之路-为什么要学习Scala以及开发环境搭建
Scala进阶之路-为什么要学习Scala以及开发环境搭建作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 最近人工智能和大数据那是相当的火呀,人工智能带动了Python的流行,区块 ...
分布式计算框架-Spark(spark环境搭建、生态环境、运行架构）
Spark涉及的几个概念:RDD:Resilient Distributed Dataset(弹性分布数据集).DAG:Direct Acyclic Graph(有向无环图).SparkContext ...
Spark学习进度-Spark环境搭建&Spark shell
Spark环境搭建下载包所需Spark包:我选择的是2.2.0的对应Hadoop2.7版本的,下载地址:https://archive.apache.org/dist/spark/spark-2. ...
Hive On Spark环境搭建
Spark源码编译与环境搭建 Note that you must have a version of Spark which does not include the Hive jars; Spar ...
Scala & IntelliJ IDEA环境搭建升级版：在JAVA中调用Scala的helloworld
--------------------- 前言 --------------------- 项目关系,希望用Spark GraphX做数据分析及图像展示,但前提是得会spark:spark是基于sc ...
攻城狮在路上（陆）-- hadoop分布式环境搭建(HA模式)
一.环境说明: 操作系统:Centos6.5 Linux node1 2.6.32-431.el6.x86_64 #1 SMP Fri Nov 22 03:15:09 UTC 2013 x86_64 ...
Hadoop之环境搭建
初学Hadoop之环境搭建阅读目录 1.安装CentOS7 2.安装JDK1.7.0 3.安装Hadoop2.6.0 4.SSH无密码登陆本文仅作为学习笔记,供大家初学Hadoop时学习参考. ...

随机推荐

DOM元素尺寸offsetWidth,scrollWidth,clientWidth等具体解释
样例: <div id="div" style="height: 200px;width: 200px;border:solid 50px red;overflow ...
优雅地乱玩Linux-6-Chrome端SSH插件
文章最初发表于szhshp的第三边境研究所转载请注明优雅地乱玩Linux-6-Chrome端SSH插件最近注册了个AWS,免费一年,一年内可以各种乱玩~ 从自己的电脑连接云主机一般需要SSH这样的 ...
beanshell
http://www.beanshell.org/download.html
Swift语言精要 - Operator(运算符重载)
运算符重载 Swift的这一语言特性或许应该启发于C++ class Vector2D { var x : Float = 0.0 var y : Float = 0.0 init (x : Floa ...
linux2.6.30.4内核移植（2）——Nand Flash驱动移植
内核源码:linux2.6.30.4 交叉编译工具:3.4.5 移植linux内核至:TQ2440 工作基础:http://www.cnblogs.com/nufangrensheng/p/36696 ...
javascript数字转大写
万亿级别,这个还有bug的 function money2Uppercase(num) { var m = parseInt(num); var ml = (m.toString()).split(' ...
linux tftp 服务
TFTP(Trivial File Transfer Protocol)是基于UDP协议开发,用来在客户机与server之间进行简单文件传输的协议,提供不复杂.开销不大的文件传输服务. 一.改动/et ...
django之创建第3个项目:编写第一个模板文件
1.django结构 2.在站点blog下创建templates文件夹,专门用于存放模板文件 3.在templates文件夹下创建index.html文件 #index.html <!DOCTY ...
QTableView中使用Delegate方式来实现对特定列的文本进行换行
问题:由于表格的一个列中,有个别文本过长,默认情况下,QTableView不支持对某列的文本换行,所以需要通过Delegate方式来实现这样的效果头文件的Delegate #pragma once ...
DOM，浏览器，javascript，html之间的关系
来源于:https://github.com/hucheng91/myBlog/blob/master/web/dom/dom.md DOM定义 DOM可以以一种独立于平台和语言的方式访问和修改一个文 ...

scala+hadoop+spark环境搭建

scala+hadoop+spark环境搭建的更多相关文章

随机推荐

热门专题