hadoop集群配置实例
1)ssh配置
http://allthingshadoop.com/2010/04/20/hadoop-cluster-setup-ssh-key-authentication/
2) 修改打开文件数限制 - 主从配置一致
/etc/security/limits.conf中增加如下配置提高打开文件限制数
hadoop soft nofile 10240
hadoop hard nofile 65536
3)配置core-site.xml - 主从配置一致(配置文件在hadoop/conf目录,下同)
<?xml version="1.0"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>
<!-- Put site-specific property overrides in this file. -->
<configuration>
<property>
<name>fs.default.name</name>
<value>hdfs://server:6060/</value>
<description>who is the namenode</description>
</property>
</configuration>
4)配置hdfs-site.xml - 主从配置一致
<?xml version="1.0"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>
<!-- Put site-specific property overrides in this file. -->
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
<final>true</final>
<description>default 3 in production environment</description>
</property>
<property>
<name>dfs.data.dir</name>
<value>/home/hadoop/hdfs/data</value>
<description>where data file is saved</description>
</property>
<property>
<name>dfs.name.dir</name>
<value>/home/hadoop/hdfs/name</value>
<description>where data meta file is saved (on namenode) </description>
</property>
<property>
<name>hadoop.tmp.dir</name>
<value>/home/hadoop/hdfs/tmp</value>
<description>A base for other temporary directories.</description>
</property>
</configuration>
目录权限
A)data目录权限
chmod 755 /home/hadoop/hdfs/data
B)namenode的数据目录不需要创建,hadoop namenode -format将自动创建
rm -rf /home/hadoop/hdfs/name
C)如果发现datanode也启动不了了
rm -rf /home/hadoop/hdfs/data
D)namenode几点显示只有一个datanode - 本机
从节点日志显示中显示
2013-11-04 15:37:29,138 INFO org.apache.hadoop.ipc.Client: Retrying connect to server: server/192.168.16.133:6060. Already tried 0 time(s).
从节点无法连接到namenode,
修改方式:
在namenode上,hostname对应地址为127.0.0.1,需要修改/etc/hosts中的127.0.0.1(注释掉)
E) 如果主从仍旧无法连接,关闭防火墙
5)修改masters - 主从配置一致
server
6)修改slaves - 主动配置一致
server
slave1
slave2
7)mapred-site.xml配置 - 主动配置一致
<?xml version="1.0"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>
<!-- Put site-specific property overrides in this file. -->
<configuration>
<property>
<name>mapred.job.tracker</name>
<value>server:8021</value>
<final>true</final>
</property>
<property>
<name>mapred.local.dir</name>
<value>/home/hadoop/mapred/local</value>
<final>true</final>
</property>
<property>
<name>mapred.system.dir</name>
<value>/home/hadoop/mapred/system</value>
<final>true</final>
</property>
<property>
<name>mapred.tasktracker.map.tasks.maximum</name>
<value>7</value>
<final>true</final>
</property>
<property>
<name>mapred.tasktracker.reduce.tasks.maximum</name>
<value>7</value>
<final>true</final>
</property>
<property>
<name>mapred.child.java.opts</name>
<value>-Xmx400m</value>
</property>
</configuration>
8)hadoop-evn.sh中配置
export JAVA_HOME=/path/to/jdk
9)初始化、启动
$ bin/hadoop namenode -format
$ bin/hadoop start-all.sh
$ hadoop dfsadmin -report
Warning: $HADOOP_HOME is deprecated.
Configured Capacity: 288730824704 (268.9 GB)
Present Capacity: 188958699520 (175.98 GB)
DFS Remaining: 188958601216 (175.98 GB)
DFS Used: 98304 (96 KB)
DFS Used%: 0%
Under replicated blocks: 0
Blocks with corrupt replicas: 0
Missing blocks: 0
-------------------------------------------------
Datanodes available: 3 (3 total, 0 dead)
Name: 192.168.16.133:50010
Decommission Status : Normal
Configured Capacity: 119873626112 (111.64 GB)
DFS Used: 40960 (40 KB)
Non DFS Used: 7385841664 (6.88 GB)
DFS Remaining: 112487743488(104.76 GB)
DFS Used%: 0%
DFS Remaining%: 93.84%
Last contact: Mon Nov 04 16:03:57 CST 2013
Name: 192.168.16.113:50010
Decommission Status : Normal
Configured Capacity: 97833930752 (91.11 GB)
DFS Used: 28672 (28 KB)
Non DFS Used: 86688358400 (80.73 GB)
DFS Remaining: 11145543680(10.38 GB)
DFS Used%: 0%
DFS Remaining%: 11.39%
Last contact: Mon Nov 04 16:03:55 CST 2013
Name: 192.168.16.156:50010
Decommission Status : Normal
Configured Capacity: 71023267840 (66.15 GB)
DFS Used: 28672 (28 KB)
Non DFS Used: 5697925120 (5.31 GB)
DFS Remaining: 65325314048(60.84 GB)
DFS Used%: 0%
DFS Remaining%: 91.98%
Last contact: Mon Nov 04 16:03:56 CST 2013
Hadoop版本1.0.3
hadoop集群配置实例的更多相关文章
- Hadoop集群配置(最全面总结)
Hadoop集群配置(最全面总结) 通常,集群里的一台机器被指定为 NameNode,另一台不同的机器被指定为JobTracker.这些机器是masters.余下的机器即作为DataNode也作为Ta ...
- 大数据测试之hadoop集群配置和测试
大数据测试之hadoop集群配置和测试 一.准备(所有节点都需要做):系统:Ubuntu12.04java版本:JDK1.7SSH(ubuntu自带)三台在同一ip段的机器,设置为静态IP机器分配 ...
- Hadoop集群配置(最全面总结 )(转)
Hadoop集群配置(最全面总结) huangguisu 通常,集群里的一台机器被指定为 NameNode,另一台不同的机器被指定为JobTracker.这些机器是masters.余下的机器即作为Da ...
- Hadoop 集群配置记录小结
Hadoop集群配置往往按照网上教程就可以"配置成功",但是你自己在操作的时候会有很多奇奇怪怪的问题出现, 我在这里整理了一下常见的问题与处理方法: 1.配置/etc/hosts ...
- hadoop集群配置和在windows系统上运用java操作hdfs
安装 配置 概念 hadoop常用shell命令 使用java操作hadoop 本文介绍hadoop集群配置和在windows系统上运用java操作hdfs 安装 http://mirror.bit. ...
- hadoop集群配置方法---mapreduce应用:xml解析+wordcount详解---yarn配置项解析
注:以下链接均为近期hadoop集群搭建及mapreduce应用开发查找到的资料.使用hadoop2.6.0,其中hadoop集群配置过程下面的文章都有部分参考. hadoop集群配置方法: ---- ...
- Hadoop集群配置搭建
环境:Centos 6.9,Hadoop 2.7.1,JDK 1.8.0_161,Maven 3.3.9 前言: 1.配置一台master服务器,两台或多台slave服务器. 2.master可 ...
- Hadoop集群配置过程中需要注意的问题
环境:VMwareWorkstation8.0 和 Ubuntu14.04 1. 使用三台虚拟机搭建Hadoop集群 2. 一定要在每台机器上配置ssh免密码登录 3. 由于需要给/etc/hosts ...
- HADOOP集群配置
http://wenku.baidu.com/view/92cbe435eefdc8d376ee32eb.html http://www.infoq.com/cn/articles/hadoop-co ...
随机推荐
- iOS - Swift NSFileManage 文件管理
前言 public class NSFileManager : NSObject public class NSFileHandle : NSObject, NSSecureCoding NSFile ...
- hdu4588Count The Carries
链接 去年南京邀请赛的水题,当时找规律过的,看它长得很像数位dp,试了试用数位dp能不能过,d出每位上有多少个1,然后TLE了..然后用规律优化了前4位,勉强过了. 附数位dp代码及找规律代码. #i ...
- Python学习(18)面向对象
目录 Python 面向对象 创建实例对象 Python内置类属性 Pyyhon对象销毁(垃圾回收) 类属性与方法 Python 面向对象 Python从设计之初就已经是一门面向对象的语言,正因为如此 ...
- 无限极分类,传递一个子ID得到所有父集,用于在前台分层显示标题
方法: static public function getParents($data,$id){ $arr=array(); foreach ($data as $v) { if ($v['id'] ...
- (四)ubuntu学习前传—uboot中对Flash和DDR的管理
1.uboot阶段Flash的分区 (1)所谓分区,就是说对Flash进行分块管理.(2)PC机等产品中,因为大家都是在操作系统下使用硬盘的,整个硬盘由操作系统统一管理,操作系统会使用文件系统帮我们管 ...
- Scala的Actor模式 & Akka框架
今天学Spark的时候,看到Scala的actor模式是一个加分点.所以搜了一下,看了.主要参考下面两篇文章,还没有实验,有些地方领会的不深刻: http://nxlhero.blog.51cto.c ...
- python操作mongodb之七时间和时区
#时间和时区 import datetime db.test.insert_one({"datetime-datetime-utcnow":datetime.datetime.ut ...
- PacBio下机数据解读
今天被人问起如何看懂三代的下机数据,虽然解决了别人的问题,但感觉自己还是没有搞透. 基本的目录结构: |-- HG002new_O1l_BP_P6_021315b_MB_100pM | |-- D01 ...
- 第二章 Python基本元素:数字、字符串和变量
Python有哪些内置的数据类型: True False #布尔型 42 100000000 #整型 3.14159 1.0e8 #浮点型 abcdes #字符串 2.1 变量.名字和对象 pytho ...
- Java客户端通过Http发送POST请求上传文件到web服务器
http://www.cnblogs.com/WilliamJiang/archive/2012/04/29/2475883.html 1.朋友的一个需求,让我给他实现,需求是这样的,需要用ASP.n ...