Hadoop生态和其他生态最大的不同之一就是“单一平台多种应用”的理念了。

hadoop能解决是什么问题:

1、HDFS :海量数据存储

MapReduce: 海量数据分析

   YARN :资源管理调度

理解: 1、资源管理调度(YARN)通过海量数据分析(MapReduce)进行对海量数据(HDFS)进行分析运算。  其中MapReduce是通过开发人员进行开发利用。

    2、Hadoop在2.0将资源管理从MapReduce中独立出来变成通用框架后,就从1.0的三层结构演变为了现在的四层架构:

    1.   底层——存储层,文件系统HDFS

    2.   中间层——资源及数据管理层,YARN以及Sentry等

    3.   上层——MapReduce、Impala、Spark等计算引擎

    4.   顶层——基于MapReduce、Spark等计算引擎的高级封装及工具,如Hive、Pig、Mahout等等

  

2、安装hadoop

  下载hadoop安装包并解压,解压后看到如下目录:

  bin: 可执行文件存放对hadoop相关服务(HDFS,YARN)进行操作的脚本

  sbin:hadoop系统可执行文件存放启动或停止hadoop相关服务的脚本

etc:hadoop的配置文件目录,存放hadoop的配置文件

lib  :存放hadoop的本地库(对数据进行压缩解压缩功能)

  share:存放hadoop的依赖jar包和文档,文档可以被删除掉

3、修改hadoop配置文件

  修改 hadoop-2.4.1/etc/hadoop目录下:

    core-site.xml 文件:

              <configuration>

              <!-- 指定HADOOP所使用的文件系统schema(URI),HDFS的master节点(老大节点)(NameNode)的地址 -->

                <property>
                  <name>fs.defaultFS</name>
                  <value>hdfs://hadoop1:9000/</value>
                </property>

                <property>
                  <name>hadoop.tmp.dir</name>
                  <value>/home/hadoop/app</value>
                </property>

              </configuration>

    hdfs-site.xml 文件:        

              <configuration>
                <property>

                    <!-- 配置HDFS副本的数量 -->
                  <name>dfs.replication</name>
                  <value>1</value>
                </property>
              </configuration>

    注意:至此HDFS已经可以独立运行

    mapred-site.xml 文件:

              <configuration>
                <property>

                  <!-- 指定mr运行在yarn上 -->
                  <name>mapreduce.framework.name</name>
                  <value>yarn</value>

                </property>

              </configuration>

    yarn-site.xml 文件:

              <configuration>

              <!-- 指定YARN的老大(ResourceManager)的地址 -->

              <!-- Site specific YARN configuration properties -->
                <property>
                  <name>yarn.resourcemanager.hostname</name>
                  <value>hadoop1</value>  

                </property>

              <!-- reducer获取数据的方式 -->

                <property>
                  <name>yarn.nodemanager.aux_services</name>
                  <value>mapreduce_shuffle</value>
                </property>

</configuration>

4、此时,基本配置都已完成,但需要关闭防火墙,以免防火请将hadoop需要的端口禁用掉。

    查看防火墙状态:service iptables status

    打开防火墙:service iptables start

    关闭防火墙:service iptables stop

    查看防火墙启动配置:sudo chkconfig iptables  --list  

      

         分别表示服务的七个档 :

            # 0 - 停机
            # 1 - 单用户模式 
            # 2 - 多用户,没有NFS 
            # 3 - 完全多用户模式(标准的运行级) 
            # 4 - 没有用到 
            # 5 - X11(xwindow) 
            # 6 - 重新启动

    开机不自启动防火请:chkconfig  iptables off

5、linux 环境变量配置

export PATH USER LOGNAME MAIL HOSTNAME HISTSIZE HISTCONTROL
export JAVA_HOME=/home/hadoop/jdk1.7.0_65
export JRE_HOME=${JAVA_HOME}/jre
export CLASSPATH=.:${JAVA_HOME}/lib:${JRE_HOME}/lib
export PATH=${JAVA_HOME}/bin:$PATH
export HADOOP_HOME=/home/hadoop/app/hadoop-2.4.1
export PATH=$PATH:$JAVA_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

6、修改 /home/hadoop/app/hadoop-2.4.1/etc/hadoop/hadoop-env.sh文件

  不修改的话,启动时,会报错JAVA_HOME找不到。

 

到此,hadoop配置基本完成

hadoop学习笔记壹 --环境搭建及配置文件的修改的更多相关文章

  1. Android Studio 学习笔记(一)环境搭建、文件目录等相关说明

    Android Studio 学习笔记(一)环境搭建.文件目录等相关说明 引入 对APP开发而言,Android和iOS是两大主流开发平台,其中区别在于 Android用java语言,用Android ...

  2. Hadoop学习之基础环境搭建

    期望目的 基于VMware workstation 10.0 + CentOS 7 + hadoop 3.2.0,在虚拟机上搭建一套Hadoop集群环境,总共包含4个节点,其中1个master节点.3 ...

  3. 我的Java学习笔记 -开发环境搭建

    开始学习Java~ 一.Java简介 Java编程语言是一种简单.面向对象.分布式.解释型.健壮安全.与系统无关.可移植.高性能.多线程和动态的语言. Java分为三个体系: JavaSE(J2SE) ...

  4. Django学习笔记 开发环境搭建

    为什么使用django?1.支持快速开发:用python开发:数据库ORM系统,并不需要我们手动地构造SQL语句,而是用python的对象访问数据库,能够提升开发效率.2.大量内置应用:后台管理系统a ...

  5. cocos2d-x lua 学习笔记(1) -- 环境搭建

    Cocos2d-x 3.0以上版本的环境搭建和之前的Cocos2d-x 2.0 版差异较大的,同时从Cocos2d-x 3.0项目打包成apk安卓应用文件,搭建安卓环境的步骤有点繁琐,但搭建一次之后, ...

  6. Mybatis学习笔记之---环境搭建与入门

    Mybatis环境搭建与入门 (一)环境搭建 (1)第一步:创建maven工程并导入jar包 <dependencies> <dependency> <groupId&g ...

  7. 【Django学习笔记】-环境搭建

    对于初学django新手,根据以下步骤可以快速进行Django环境搭建 虚拟环境创建 使用virtualenv创建并启用虚拟机环境 ,关于virtualenv可参考https://www.yuque. ...

  8. SpringData JPA的学习笔记之环境搭建

    一.环境搭建 1.加入jar包   spring jar+jpa jar +springData jar >>SpringData jar包     2.配置applicationCont ...

  9. 前端框架vue学习笔记:环境搭建

    兼容性 不兼容IE8以下 Vue Devtools 能够更好的对界面进行审查和调试 环境搭建 1.nodejs(新版本的集成了npm)[npm是node包管理 node package manager ...

随机推荐

  1. c#实战开发:以太坊钱包对接私链 (二)

    上一篇讲了 以太坊私链搭建 首先下载Ethereum Wallet 钱包 可以直接百度 下载如果直接打开它会默认连接公链 所以我们要通过命令打开 "F:\Program Files\Ethe ...

  2. scala简单入门_wordCount

    scala的语法写起来是非常的舒服的,相比java来说,简便许多.而Java在scala面前就显的略微有些笨重了. 接下来我们看一下scala版的wordcount import scala.io.S ...

  3. jQ效果:jQuery时间轴插件jQuery Timelinr

    前言 这是一款可用于展示历史和计划的时间轴插件,尤其比较适合一些网站展示发展历程.大事件等场景.该插件基于jQuery,可以滑动切换.水平和垂直滚动.支持键盘方向键.经过扩展后可以支持鼠标滚轮事件. ...

  4. React中props和state相同点和不同点

    朋友们,我想死你们了,最近这几天忙着和病魔作斗争所以没怎么写博客,今天感觉好点了,赶紧来写一波,就是这木敬业. 今天我们来讨论讨论props和state相同点和不同点 首先我来概要说明一下这两者 pr ...

  5. 使用fiddle处理跨域

    认真的用fiddle处理跨域 相信很多前端的同学都或多或少被跨域这个问题烦恼过,网上很多处理的方式其实都是要后端处理, 用fiddle来处理 ,就不必看后端的脸色了,自己安安心心的倒腾接口,何乐而不为 ...

  6. 我的Java之旅 第五课 JAVA 语言语法 集合

    JAVA集合只能存放引用类型的的数据,不能存放基本数据类型,int 可以用 Integer代替. 一.集合接口  1.  Iterable<E> 实现这个接口允许对象成为 "fo ...

  7. nginx-2-nginx的反向代理

    Nginx服务器的反向代理服务 nginx服务器的反向代理服务是其最常用的重要功能之一,在实际的工作当中应用广泛,涉及的指令也比较多,各类指令完成的功能也不尽相同.

  8. Linux 时间及时区设置

    时间以及时区设置 by:授客 QQ:1033553122 1.首先确认使用utc还是local time. UTC(Universal Time Coordinated)=GMT(Greenwich ...

  9. 安卓开发-设置RadioButton的点击效果

    在安卓开发中用到底部菜单栏 需要用到RadioButton这个组件 实际应用的过程中,需要对按钮进行点击,为了让用户知道是否点击可这个按钮,可以设置点击后 ,该按钮的颜色或者背景发生变化. layou ...

  10. 在td中的输入英文为什么不自动换行???

    在表格中如果输入纯汉字,表格中的内容会根据表格大小进行换行,若果一个老外不会写汉字,写了一堆英文,表格的宽度会拉的很长,超过规定宽度 解决方法是在table中加上style="table-l ...