主要包括以下三部分,本文为第二部分:

一. Scala环境准备 查看

二. Hadoop集群(伪分布模式)安装

三. Spark集群(standalone模式)安装 查看

Hadoop集群(伪分布模式)安装

  1. 依赖项:jdk(hadoop与java版本兼容性参考链接)、ssh;

    执行ssh localhost若提示:

    localhost: ssh: connect to host localhost port 22: Connection refused

    则需要:

    a.检查是否安装了openssh,若没有则建议通过brew install openssh安装(需要先安装brew,安装brew前还需要先安装xcode,安装方法见官网,官网的方法若超时,可以先在浏览器中打开curl链接并复制到本地保存(如~/Desktop/install),然后修改安装命令为:

    /usr/bin/ruby -e "$(cat ~/Desktop/install)"

    ),启动方式:

    sudo /usr/sbin/sshd

    若启动失败并提示:

    Could not load host key: /etc/ssh/ssh_host_rsa_key

    Could not load host key: /etc/ssh/ssh_host_dsa_key

    Could not load host key: /etc/ssh/ssh_host_ecdsa_key

    Could not load host key: /etc/ssh/ssh_host_ed25519_key

    则,执行以下操作后重新启动:

    sudo cp ~/.ssh/id_rsa /etc/ssh/ssh_host_rsa

    sudo cp ~/.ssh/id_rsa.pub /etc/ssh/ssh_host_rsa.pub

    启动后通过ps -ef | grep ssh检查ssh服务是否存在

    b.检查是否存在以下文件,且authorized_keys 中包含id_rsa.pub中的内容

    ~/.ssh/id_rsa.pub

    ~/.ssh/id_rsa

    ~/.ssh/authorized_keys

    若没有id_rsa.*文件,则执行以下操作:

    ssh-keygen -t rsa

    cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys

    chmod 0600 ~/.ssh/authorized_keys

  2. 修改/etc/hosts文件(可选)

    添加本机ip到localhost的映射(sudo vim /etc/hosts),如下所示:

    xx.xx.xx.xx    localhost

    这一步是为了可以使用形如:hdfs://xx.xx.xx.xx:9000/file/path的格式访问hdfs,否则只能使用localhost。

  3. 下载hadoop-2.7.6安装包,解压到~/tools/hadoop-2.7.6

  4. 修改配置

    a.etc/hadoop/core-site.xml中添加如下配置:

        <configuration>
    <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
    </property>
    </configuration>
    ``` b.etc/hadoop/hdfs-site.xml中添加如下配置:
    ```xml
    <configuration>
    <property>
    <name>dfs.replication</name>
    <value>1</value>
    </configuration>
    ``` <b>以上为hdfs相关配置,若要使用yarn,还需进行以下配置</b>
    c.拷贝etc/hadoop/mapred-site.xml.template到etc/hadoop/mapred-site.xml并添加如下配置:
    ```xml
    <configuration>
    <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
    </property>
    </configuration>
    ``` d.etc/hadoop/yarn-site.xml中添加如下配置:
    ```xml
    <configuration>
    <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
    </property>
    </configuration>
    ``` 注:默认存储路径为/tmp/hadoop-&lt;username&gt;/,可以通过配置 “dfs.namenode.name.dir”、 “dfs.datanode.data.dir” 显式指定,参考[文档](http://hadoop.apache.org/docs/r2.7.6/hadoop-project-dist/hadoop-common/ClusterSetup.html#Configuring_the_Hadoop_Daemons "文档");
  5. 启动服务

    a.格式化namenode

    ./bin/hdfs namenode -format

    b.启动HDFS

    ./sbin/start-dfs.sh

    c.若要启用历史任务服务,执行以下命令:

    ./sbin/mr-jobhistory-daemon.sh start historyserver

    d.若要使用yarn,执行以下命令

    ./sbin/start-yarn.sh

    启动后通过jps命令查看启动的服务,应包含:DataNode、NameNode、SecondaryNameNode(若启动了yarn,还包括:NodeManager、ResourceManager;若启动了历史服务,还包括:JobHistoryServer);

  6. 通过以下网址查看服务状态

    a.历史任务:http://localhost:19888/

    b.集群状态:http://localhost:8088/

    c.NameNode状态:http://localhost:50070/

  7. 测试

    通过以下命令测试hdfs是否可用:

    ./bin/hadoop fs -ls /

    ./bin/hadoop fs -ls hdfs://localhost:9000/

    ./bin/hadoop fs -ls hdfs://xx.xx.xxx.xxx:9000/

    ./bin/hdfs dfs -ls /

    ./bin/hdfs dfs -ls hdfs://localhost:9000/

    ./bin/hdfs dfs -ls hdfs://xx.xx.xxx.xxx:9000/

    若服务可用,需要创建以下目录:

    hdfs://localhost:9000/user/<username>

  8. 停止服务

    可将以下命令写入stop.sh批量执行:

    ./sbin/stop-dfs.sh

    ./sbin/stop-yarn.sh

    ./sbin/mr-jobhistory-daemon.sh stop historyserver

注:若配置了yarn(4.c),则官网中下面的例子是无法成功执行的;若只配置了hdfs(4.a,4.b),是没有问题的:

    bin/hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-2.7.6.jar grep input output 'dfs[a-z.]+'

参考文档:官方文档

Spark新手入门——2.Hadoop集群(伪分布模式)安装的更多相关文章

  1. 3-2 Hadoop集群伪分布模式配置部署

    Hadoop伪分布模式配置部署 一.实验介绍 1.1 实验内容 hadoop配置文件介绍及修改 hdfs格式化 启动hadoop进程,验证安装 1.2 实验知识点 hadoop核心配置文件 文件系统的 ...

  2. Hadoop集群搭建-05安装配置YARN

    Hadoop集群搭建-04安装配置HDFS  Hadoop集群搭建-03编译安装hadoop Hadoop集群搭建-02安装配置Zookeeper Hadoop集群搭建-01前期准备 先保证集群5台虚 ...

  3. Hadoop集群搭建-04安装配置HDFS

    Hadoop集群搭建-05安装配置YARN Hadoop集群搭建-04安装配置HDFS  Hadoop集群搭建-03编译安装hadoop Hadoop集群搭建-02安装配置Zookeeper Hado ...

  4. Hadoop集群搭建-02安装配置Zookeeper

    Hadoop集群搭建-05安装配置YARN Hadoop集群搭建-04安装配置HDFS  Hadoop集群搭建-03编译安装hadoop Hadoop集群搭建-02安装配置Zookeeper Hado ...

  5. 大数据初级笔记二:Hadoop入门之Hadoop集群搭建

    Hadoop集群搭建 把环境全部准备好,包括编程环境. JDK安装 版本要求: 强烈建议使用64位的JDK版本,这样的优势在于JVM的能够访问到的最大内存就不受限制,基于后期可能会学习到Spark技术 ...

  6. 使用Docker搭建Hadoop集群(伪分布式与完全分布式)

    之前用虚拟机搭建Hadoop集群(包括伪分布式和完全分布式:Hadoop之伪分布式安装),但是这样太消耗资源了,自学了Docker也来操练一把,用Docker来构建Hadoop集群,这里搭建的Hado ...

  7. 大数据系列(5)——Hadoop集群MYSQL的安装

    前言 有一段时间没写文章了,最近事情挺多的,现在咱们回归正题,经过前面四篇文章的介绍,已经通过VMware安装了Hadoop的集群环境,相关的两款软件VSFTP和SecureCRT也已经正常安装了. ...

  8. hadoop集群监控工具ambari安装

    Apache Ambari是对Hadoop进行监控.管理和生命周期管理的基于网页的开源项目.它也是一个为Hortonworks数据平台选择管理组建的项目.Ambari支持管理的服务有: Apache ...

  9. 基于Hadoop集群搭建Hive安装与配置(yum插件安装MySQL)---linux系统《小白篇》

    用到的安装包有: apache-hive-1.2.1-bin.tar.gz mysql-connector-java-5.1.49.tar.gz 百度网盘链接: 链接:https://pan.baid ...

随机推荐

  1. VMware虚拟机网络设置

    背景介绍 在用 VMware workstation 安装好虚拟机后,需要给虚拟机配置网络,配置网络的方法有桥接.NAT.    采用桥接的方法需要占据物理机网段的ip地址,可能会与物理机同一网段的其 ...

  2. centos7安装python3.6后导致防火墙功能无法正常工作的解决办法

    问题:因为默认python版本被设置成了python3.6,而进行防火墙的指令操作频频报错. Jul 19 16:30:51 localhost.localdomain systemd[1]: Sta ...

  3. android-基础编程-ExpandableListview

    ExpandableListView继承ListView,具有LIstVIew的基本功能.此外具有group/child,由组与子元素组成. 1.布局主要有是三个. a.主布局: <Expand ...

  4. [转]WordPress“添加媒体”文件时只显示上传到当前文章的附件图片

    使用WordPress的朋友应该都清楚,特别是喜欢图文并茂的网站,肯定离不开的就是WordPress文章编辑页面的“添加媒体”按钮,每次点击就能弹出一个插入多媒体的界面,然后页面默认就会列举加载所有最 ...

  5. Springboot高版本中@ConfigurationProperties注解取消location属性

    在spring boot 1.5 版本之前 在@ConfigurationProperties注释中有两个属性:locations:指定配置文件的所在位置prefix:指定配置文件中键名称的前缀 sp ...

  6. Do More With These Great Plugins for Windows Live Writer(old)

    This article is out of day,now we use open live wirter, but we don’t have so much works great plugin ...

  7. MFC 多窗口通信时,使用RadioButton和Button时冲突问题

    最近项目需要我们实现在两个窗口间进行通信,其中有个小功能如图所示: 当我点击GDIProgram中的Button1时,会更新Dialog的Radio1和Radio2的状态. Dialog中的Radio ...

  8. mybatis 控制台打印sql语句

    其实很简单,打印SQL只需要加一个setting就可以了.亲测可用. mybatis-config.xml: <settings>        <setting name=&quo ...

  9. Swift5 语言指南(九) 闭包

    闭包是自包含的功能块,可以在代码中传递和使用.Swift中的闭包类似于C和Objective-C中的块以及其他编程语言中的lambdas. 闭包可以从定义它们的上下文中捕获和存储对任何常量和变量的引用 ...

  10. linux常用的BootLoader U-boot的前世今生

    U-Boot,全称 Universal Boot Loader,是遵循GPL条款的开放源码项目.U-Boot的作用是系统引导. U-Boot从FADSROM.8xxROM.PPCBOOT逐步发展演化而 ...