1)ssh配置

http://allthingshadoop.com/2010/04/20/hadoop-cluster-setup-ssh-key-authentication/

2) 修改打开文件数限制  - 主从配置一致

/etc/security/limits.conf中增加如下配置提高打开文件限制数

hadoop soft nofile 10240

hadoop hard nofile 65536



3)配置core-site.xml  - 主从配置一致(配置文件在hadoop/conf目录,下同)

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<!-- Put site-specific property overrides in this file. -->

<configuration>

    <property>

        <name>fs.default.name</name>

        <value>hdfs://server:6060/</value>

        <description>who is the namenode</description>

    </property>

</configuration>

4)配置hdfs-site.xml  - 主从配置一致

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<!-- Put site-specific property overrides in this file. -->

<configuration>

    <property>

        <name>dfs.replication</name>

        <value>1</value>

        <final>true</final>

        <description>default 3 in production environment</description>

    </property>

    <property>

        <name>dfs.data.dir</name>

        <value>/home/hadoop/hdfs/data</value>

        <description>where data file is saved</description>

    </property>

    <property>

        <name>dfs.name.dir</name>

        <value>/home/hadoop/hdfs/name</value>

        <description>where data meta file is saved (on namenode) </description>

    </property>

    <property>

        <name>hadoop.tmp.dir</name>

        <value>/home/hadoop/hdfs/tmp</value>

        <description>A base for other temporary directories.</description>

    </property>

</configuration>



目录权限

A)data目录权限

chmod 755 /home/hadoop/hdfs/data

B)namenode的数据目录不需要创建,hadoop namenode -format将自动创建

rm -rf /home/hadoop/hdfs/name



C)如果发现datanode也启动不了了

rm -rf /home/hadoop/hdfs/data



D)namenode几点显示只有一个datanode - 本机

从节点日志显示中显示

2013-11-04 15:37:29,138 INFO org.apache.hadoop.ipc.Client: Retrying connect to server: server/192.168.16.133:6060. Already tried 0 time(s).

从节点无法连接到namenode,

修改方式:

在namenode上,hostname对应地址为127.0.0.1,需要修改/etc/hosts中的127.0.0.1(注释掉)

E) 如果主从仍旧无法连接,关闭防火墙



5)修改masters - 主从配置一致

server



6)修改slaves - 主动配置一致

server

slave1

slave2

7)mapred-site.xml配置  - 主动配置一致

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<!-- Put site-specific property overrides in this file. -->

<configuration>

    <property>

        <name>mapred.job.tracker</name>

        <value>server:8021</value>

        <final>true</final>

    </property>

    <property>

        <name>mapred.local.dir</name>

        <value>/home/hadoop/mapred/local</value>

        <final>true</final>

    </property>

    <property>

        <name>mapred.system.dir</name>

        <value>/home/hadoop/mapred/system</value>

        <final>true</final>

    </property>

    <property>

        <name>mapred.tasktracker.map.tasks.maximum</name>

        <value>7</value>

        <final>true</final>

    </property>

    <property>

        <name>mapred.tasktracker.reduce.tasks.maximum</name>

        <value>7</value>

        <final>true</final>

    </property>

    <property>

        <name>mapred.child.java.opts</name>

        <value>-Xmx400m</value>

    </property>

</configuration>

8)hadoop-evn.sh中配置

export JAVA_HOME=/path/to/jdk

9)初始化、启动

$ bin/hadoop namenode -format
$ bin/hadoop start-all.sh

$ hadoop dfsadmin -report

Warning: $HADOOP_HOME is deprecated.



Configured Capacity: 288730824704 (268.9 GB)

Present Capacity: 188958699520 (175.98 GB)

DFS Remaining: 188958601216 (175.98 GB)

DFS Used: 98304 (96 KB)

DFS Used%: 0%

Under replicated blocks: 0

Blocks with corrupt replicas: 0

Missing blocks: 0



-------------------------------------------------

Datanodes available: 3 (3 total, 0 dead)



Name: 192.168.16.133:50010

Decommission Status : Normal

Configured Capacity: 119873626112 (111.64 GB)

DFS Used: 40960 (40 KB)

Non DFS Used: 7385841664 (6.88 GB)

DFS Remaining: 112487743488(104.76 GB)

DFS Used%: 0%

DFS Remaining%: 93.84%

Last contact: Mon Nov 04 16:03:57 CST 2013





Name: 192.168.16.113:50010

Decommission Status : Normal

Configured Capacity: 97833930752 (91.11 GB)

DFS Used: 28672 (28 KB)

Non DFS Used: 86688358400 (80.73 GB)

DFS Remaining: 11145543680(10.38 GB)

DFS Used%: 0%

DFS Remaining%: 11.39%

Last contact: Mon Nov 04 16:03:55 CST 2013





Name: 192.168.16.156:50010

Decommission Status : Normal

Configured Capacity: 71023267840 (66.15 GB)

DFS Used: 28672 (28 KB)

Non DFS Used: 5697925120 (5.31 GB)

DFS Remaining: 65325314048(60.84 GB)

DFS Used%: 0%

DFS Remaining%: 91.98%

Last contact: Mon Nov 04 16:03:56 CST 2013

Hadoop版本1.0.3

hadoop集群配置实例的更多相关文章

  1. Hadoop集群配置(最全面总结)

    Hadoop集群配置(最全面总结) 通常,集群里的一台机器被指定为 NameNode,另一台不同的机器被指定为JobTracker.这些机器是masters.余下的机器即作为DataNode也作为Ta ...

  2. 大数据测试之hadoop集群配置和测试

    大数据测试之hadoop集群配置和测试   一.准备(所有节点都需要做):系统:Ubuntu12.04java版本:JDK1.7SSH(ubuntu自带)三台在同一ip段的机器,设置为静态IP机器分配 ...

  3. Hadoop集群配置(最全面总结 )(转)

    Hadoop集群配置(最全面总结) huangguisu 通常,集群里的一台机器被指定为 NameNode,另一台不同的机器被指定为JobTracker.这些机器是masters.余下的机器即作为Da ...

  4. Hadoop 集群配置记录小结

    Hadoop集群配置往往按照网上教程就可以"配置成功",但是你自己在操作的时候会有很多奇奇怪怪的问题出现, 我在这里整理了一下常见的问题与处理方法: 1.配置/etc/hosts ...

  5. hadoop集群配置和在windows系统上运用java操作hdfs

    安装 配置 概念 hadoop常用shell命令 使用java操作hadoop 本文介绍hadoop集群配置和在windows系统上运用java操作hdfs 安装 http://mirror.bit. ...

  6. hadoop集群配置方法---mapreduce应用:xml解析+wordcount详解---yarn配置项解析

    注:以下链接均为近期hadoop集群搭建及mapreduce应用开发查找到的资料.使用hadoop2.6.0,其中hadoop集群配置过程下面的文章都有部分参考. hadoop集群配置方法: ---- ...

  7. Hadoop集群配置搭建

    环境:Centos 6.9,Hadoop 2.7.1,JDK 1.8.0_161,Maven 3.3.9 前言: 1.配置一台master服务器,两台或多台slave服务器.    2.master可 ...

  8. Hadoop集群配置过程中需要注意的问题

    环境:VMwareWorkstation8.0 和 Ubuntu14.04 1. 使用三台虚拟机搭建Hadoop集群 2. 一定要在每台机器上配置ssh免密码登录 3. 由于需要给/etc/hosts ...

  9. HADOOP集群配置

    http://wenku.baidu.com/view/92cbe435eefdc8d376ee32eb.html http://www.infoq.com/cn/articles/hadoop-co ...

随机推荐

  1. iOS - Swift NSFileManage 文件管理

    前言 public class NSFileManager : NSObject public class NSFileHandle : NSObject, NSSecureCoding NSFile ...

  2. hdu4588Count The Carries

    链接 去年南京邀请赛的水题,当时找规律过的,看它长得很像数位dp,试了试用数位dp能不能过,d出每位上有多少个1,然后TLE了..然后用规律优化了前4位,勉强过了. 附数位dp代码及找规律代码. #i ...

  3. Python学习(18)面向对象

    目录 Python 面向对象 创建实例对象 Python内置类属性 Pyyhon对象销毁(垃圾回收) 类属性与方法 Python 面向对象 Python从设计之初就已经是一门面向对象的语言,正因为如此 ...

  4. 无限极分类,传递一个子ID得到所有父集,用于在前台分层显示标题

    方法: static public function getParents($data,$id){ $arr=array(); foreach ($data as $v) { if ($v['id'] ...

  5. (四)ubuntu学习前传—uboot中对Flash和DDR的管理

    1.uboot阶段Flash的分区 (1)所谓分区,就是说对Flash进行分块管理.(2)PC机等产品中,因为大家都是在操作系统下使用硬盘的,整个硬盘由操作系统统一管理,操作系统会使用文件系统帮我们管 ...

  6. Scala的Actor模式 & Akka框架

    今天学Spark的时候,看到Scala的actor模式是一个加分点.所以搜了一下,看了.主要参考下面两篇文章,还没有实验,有些地方领会的不深刻: http://nxlhero.blog.51cto.c ...

  7. python操作mongodb之七时间和时区

    #时间和时区 import datetime db.test.insert_one({"datetime-datetime-utcnow":datetime.datetime.ut ...

  8. PacBio下机数据解读

    今天被人问起如何看懂三代的下机数据,虽然解决了别人的问题,但感觉自己还是没有搞透. 基本的目录结构: |-- HG002new_O1l_BP_P6_021315b_MB_100pM | |-- D01 ...

  9. 第二章 Python基本元素:数字、字符串和变量

    Python有哪些内置的数据类型: True False #布尔型 42 100000000 #整型 3.14159 1.0e8 #浮点型 abcdes #字符串 2.1 变量.名字和对象 pytho ...

  10. Java客户端通过Http发送POST请求上传文件到web服务器

    http://www.cnblogs.com/WilliamJiang/archive/2012/04/29/2475883.html 1.朋友的一个需求,让我给他实现,需求是这样的,需要用ASP.n ...