前言

  本文介绍如何在Ubuntu Kylin操作系统上搭建Hadoop平台。

配置

  1. 操作系统: Ubuntu Kylin 14.04

  2. 编程语言: JDK 1.8

  3. 通信协议: SSH

  2. 云计算项目版本: Hadoop 1.2.1

第一步:安装最新版本的JDK (若已经安装过请忽略这一步)

  1. 去官网下载JDK1.8并解压 (当前安装包为:jdk-8u25-linux-x64.gz)

  2. 将解压后的安装包复制到 /usr/lib/jvm 目录下 (jvm目录需要自行创建)

  3. 以管理员方式打开 /etc/profile 文件并在文件底部添加以下代码:

 #set Java Environment
 export JAVA_HOME=/usr/lib/jvm/jdk1..0_25
 export CLASSPATH=".:$JAVA_HOME/lib:$CLASSPATH"
 export PATH="$JAVA_HOME/bin:$PATH"

  4. 执行以下命令使配置文件立即生效:

 source /etc/profile

  5. 执行以下命令验证JDK是否安装成功:

1 java -version

  若显示以下信息表示安装完成:

   

第二步:配置SSH免密码登陆

  1. 执行以下命令安装SSH:

1 sudo app-get install ssh

  2. 检查用户目录下是不是有个名为.ssh的隐藏文件夹,没有的话就自己创建一个。

  3. 执行以下命令配置SSH无密码登陆 (这几行代码的功能请参考SSH使用文档):

 ssh-keygen -t dsa -P '' -f ~/.ssh/id_dsa
 cat ~/.ssh/id_dsa.pub >> ~/.ssh/authorized_keys

  4. 执行以下命令验证SSH是否安装配置成功:

 ssh localhost

  出现提示输入yes,若终端显示以下信息,表示SSH配置成功:

  

第三步:安装并运行Hadoop

  说明:Hadoop有三种运行方式 - 单机模式,伪分布式和完全分布式。其中,前两者主要用于程序的测试和调试,这里要讲的是伪分布式的配置,配置完全分布式的方法将在以后讲解。

  1. 下载并解压最新版本的Hadoop到当前目录下 (当前安装包为:hadoop-1.2.1.tar.gz)

  2. 进入conf子目录中,修改如下配置文件:

    a. hadoop-env.sh (设置JAVA路径)

    在末尾添加:

 export JAVA_HOME=/usr/lib/jvm/jdk1..0_25

    b. core-site.xml (配置HDFS地址及端口号)

    配置为:

 <?xml version="1.0"?>
 <?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

 <!-- Put site-specific property overrides in this file. -->

 <configuration>
         <property>
                 <name>fs.default.name</name>
                 <value>hdfs://localhost:9000</value>
         </property>
 </configuration>

    c. hdfs-site.xml (修改备份方式,单机版本需要将其改为1)

    配置为:

 <?xml version="1.0"?>
 <?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

 <!-- Put site-specific property overrides in this file. -->

 <configuration>
         <property>
                 <name>dfs.replication</name>
                 <value></value>
         </property>
 </configuration>

    d. mapred-site.xml (设置JobTracker地址及端口)

    配置为:

 <?xml version="1.0"?>
 <?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

 <!-- Put site-specific property overrides in this file. -->

 <configuration>
         <property>
                 <name>mapred.job.tracker</name>
                 <value>localhost:</value>
         </property>
 </configuration>

  3. 进入Hadoop文件夹执行以下命令以格式化Hadoop文件系统HDFS:

 bin/hadoop namenode -format

  4. 执行以下命令以启动所有Hadoop进程:

 bin/start-all.sh

  5. 验证Hadoop是否安装成功

    a. 打开浏览器,输入网址 http://localhost:50030 以查看MapReduce的Web页面:

    

    b. 打开浏览器,输入网址 http://localhost:50070 以查看HDFS的Web页面:

    

    如果显示正常,那么Hadoop环境便搭建好了。

小结

  1. 伪分布式的架构,机制和真实分布式其实是一样的,不过伪分布式中,Master和Slave都是一台机器。

  2. 关于真实分布式环境的搭建,将在以后介绍。到时会在虚拟机上组建一个虚拟网络,跑真·分布式程序。

Hadoop 在ubuntu系统上的搭建[图解]的更多相关文章

  1. [Hadoop] 在Ubuntu系统上一步步搭建Hadoop(单机模式)

    1 Hadoop的三种创建模式 单机模式操作是Hadoop的默认操作模式,当首次解压Hadoop的源码包时,Hadoop无法了解硬件安装环境,会保守地选择最小配置,即单机模式.该模式主要用于开发调试M ...

  2. 第二篇:Hadoop 在Ubuntu Kylin系统上的搭建[图解]

    前言 本文介绍如何在Ubuntu Kylin操作系统上搭建Hadoop平台. 配置 1. 操作系统: Ubuntu Kylin 14.04 2. 编程语言: JDK 1.8 3. 通信协议: SSH ...

  3. 在Ubuntu系统上搭建Hadoop 2.x(2.6.2)

    官方的中文版的Hadoop快速入门教程已经是很老的版本了,新版的Hadoop目录结构发生了变化,因此一些配置文件的位置也略微调整了,例如新版的hadoop中找不到快速入门中提到的conf目录,另外,网 ...

  4. 如何在一个ubuntu系统上搭建SVN版本控制工具

    有话说,由于公司项目部署需要,将Windows工程迁移到Linux,通过调查确定使用Ubuntu的Linux操作系统.那么如何快速搭建和Windows一样快捷方便的开发环境就很重要了.本文讲述如何在一 ...

  5. 64位的Ubuntu系统上使用汇编nasm和C语言

    64位的Ubuntu系统上使用汇编nasm和C语言 $ nasm -f elf foo.asm -o foo.o$ gcc -c bar.c -o bar.o$ ld -s  foo.o bar.o ...

  6. 在64位Ubuntu系统上安装32位程序包

    在64位Ubuntu系统上安装32位的程序包 $sudo apt-get install package_name:i386 例如: $sudo apt-get install openjdk-7-j ...

  7. 孤荷凌寒自学python第六十一天在Fedora28版的linux系统上找搭建本地Mongodb数据服务

    孤荷凌寒自学python第六十一天在Fedora28版的linux系统上找搭建本地Mongodb数据服务 (完整学习过程屏幕记录视频地址在文末) 今天是学习mongoDB数据库的第七天.成功在本地搭建 ...

  8. Nginx: ubuntu系统上查找nginx.conf配置文件的路径

    问题描述:在ubuntu系统上,找到nginx.conf文件的位置. 解决方法:在终端窗口中,输入命令:nginx -t 回显中就可以看到nginx.conf文件的路径了. 参考:https://bl ...

  9. Nginx: ubuntu系统上如何判断是否安装了Nginx?

    问题描述:ubuntu系统上,如何查看是否安装了Nginx? 解决方法:输入命令行:ps -ef | grep nginx master process后面就是Nginx的安装目录. 延伸:1. 如何 ...

随机推荐

  1. The APR based Apache Tomcat Native library 异常解决办法

    tomat在linux服务器上启动报The APR based Apache Tomcat Native library which allows optimal performance in pro ...

  2. JBOSS常用端口说明

    1.jboss 的端口修改位置总结 Jboss通常占用的端口是1098,1099,4444,4445,8080,8009,8083,8093这几个, 默认端口是8080 在windows系统中: 10 ...

  3. ANGULARJS 动态编译添加到dom中

    在使用angularjs 时,希望通过动态构建angular模版,再通过angular进行展示. 使用 方法如下: <html ng-app="app"> <he ...

  4. mysql在一台服务器搭建主从1

    1. 登录mysq的方法:  mysql-S /tmp/mysql.sock 登录3306  mysql -S /tmp/mysql_slave.sock 登录3307 mysql -h 127.0. ...

  5. 终于!Linaro 加盟 Zephyr 项目

    导读 为物联网构建实时操作系统的开源协作项目 Zephyr 项目宣布,Linaro 有限责任公司以白金会员的身份加盟该项目.Linaro是一家为 ARM 架构开发开源软件的协作工程组织,也是全球性机构 ...

  6. 用while循环语句计算1!+2!+……20!之和

    package nothh; public class mmm { public static void main(String[] args) { // TODO Auto-generated me ...

  7. java基础之 string

    一 string public final class String 继承自java.lang.Object类. 实现了接口: java.io.Serializable, Comparable< ...

  8. [转]理解WSRF之一 使用WS-ResourceProperties (整理自IBM网站)

    理解 WSRF第1部分-使用 WS-ResourceProperties   本 教程是一个由 4 部分组成的系列文章中的第 1 部分,该系列介绍 WSRF(Web Services Resource ...

  9. PHP Array 函数

    PHP Array 简介 array 函数允许您对数组进行操作. PHP 支持单维和多维的数组.同时提供了用数据库查询结果来构造数组的函数. 安装 array 函数是 PHP 核心的组成部分.无需安装 ...

  10. 在MongoDB中实现聚合函数 (转)

    随着组织产生的数据爆炸性增长,从GB到TB,从TB到PB,传统的数据库已经无法通过垂直扩展来管理如此之大数据.传统方法存储和处理数据的成本将会随着数据量增长而显著增加.这使得很多组织都在寻找一种经济的 ...