hadoop学习笔记叁--简单应用

1、通过命令向HDFS传输文件

　　　　上传：./hadoop fs -put hdfs.cmd （本地文件名） hdfs://主机名称:9000/

　　　　　　hadoop fs -copyFromLocal ./hadoop-config.cmd（本地文件名） /user/（hadoop服务路径）

　　　　下载： ./hadoop fs -get hdfs://主机名称:9000/hdfs.cmd

　　　　　　　　hadoop fs -copyToLocal /user/jdk-7u65-linux-i586.tar.gz （hadoop文件位置路径） /home/hadoop/app/（本地路径）

　　　　在浏览器访问http://主机IP:50070，出现以下页面点击如图所示按钮，会看到上传的文件。

2、执行hadoop自带mapreduce程序

　　　　到hadoop-2.4.1/share/hadoop/mapreduce 目录下

　　　　执行命令：./hadoop jar ../share/hadoop/mapreduce/hadoop-mapreduce-examples-2.4.1.jar pi 5 5（jar的主类全路径）

3、hadoop ：hdfs 存放文件方式

　　　　hadoop存放文件方式：切分存放，就是讲一个文件切分为数块，然后放到集群DATANODE中，通过NAMENODE来映射每个DATANODE中存放的数据

　　相当于上传一个文件名为test.txt被分为ABC三块，集群中有三台主机，分别有三个DATANODE ：“123” 那么当test.txt被上传到hadoop时，A块放于1 ；B块放于2：C块放于3

　　　而 NAMENODE则记录：A对应1 B对应2 C对应3的映射关系

　　　　当向haddop下载时，则先经过NAMENODE映射关系进行文件组装，然后下载到请求指定的位置

　　　　总结：

　　　　1、hdfs是通过分布式集群来存储文件的，且提供虚拟目录用来便捷访问

　　　　2、文件存储到hdfs集群中去时，会被拆分为多个block

　　　　3、文件block存放于多个datanode中

　　　　4、hdfs文件系统中的文件与真实文件映射关系有namenode管理

　　　　5、block存储的是我们的数据文件，按照块号存储的物理文件。

　　　　6、每个block在集群中会出现多个副本，提高文件可靠性，和访问吞吐量。

4、core-site.xml设置的NAMENODE节点地址信息

　 slaves 设置的是DATANODE节点信息

hadoop学习笔记叁--简单应用的更多相关文章

Hadoop学习笔记—22.Hadoop2.x环境搭建与配置
自从2015年花了2个多月时间把Hadoop1.x的学习教程学习了一遍,对Hadoop这个神奇的小象有了一个初步的了解,还对每次学习的内容进行了总结,也形成了我的一个博文系列<Hadoop学习笔 ...
Hadoop学习笔记(6) ——重新认识Hadoop
Hadoop学习笔记(6) ——重新认识Hadoop 之前,我们把hadoop从下载包部署到编写了helloworld,看到了结果.现是得开始稍微更深入地了解hadoop了. Hadoop包含了两大功 ...
Hadoop学习笔记(2)
Hadoop学习笔记(2) ——解读Hello World 上一章中,我们把hadoop下载.安装.运行起来,最后还执行了一个Hello world程序,看到了结果.现在我们就来解读一下这个Hello ...
Hadoop学习笔记(5) ——编写HelloWorld(2)
Hadoop学习笔记(5) ——编写HelloWorld(2) 前面我们写了一个Hadoop程序,并让它跑起来了.但想想不对啊,Hadoop不是有两块功能么,DFS和MapReduce.没错,上一节我 ...
Hadoop学习笔记(2) ——解读Hello World
Hadoop学习笔记(2) ——解读Hello World 上一章中,我们把hadoop下载.安装.运行起来,最后还执行了一个Hello world程序,看到了结果.现在我们就来解读一下这个Hello ...
Hadoop学习笔记(1) ——菜鸟入门
Hadoop学习笔记(1) ——菜鸟入门 Hadoop是什么?先问一下百度吧: [百度百科]一个分布式系统基础架构,由Apache基金会所开发.用户可以在不了解分布式底层细节的情况下,开发分布式程序. ...
Hadoop学习笔记（两）设置单节点集群
本文描写叙述怎样设置一个单一节点的 Hadoop 安装.以便您能够高速运行简单的操作,使用 Hadoop MapReduce 和 Hadoop 分布式文件系统 (HDFS). 參考官方文档:Hadoo ...
Hadoop学习笔记(1)（转）
Hadoop学习笔记(1) ——菜鸟入门 Hadoop是什么?先问一下百度吧: [百度百科]一个分布式系统基础架构,由Apache基金会所开发.用户可以在不了解分布式底层细节的情况下,开发分布式程序. ...
Hadoop学习笔记(10) ——搭建源码学习环境
Hadoop学习笔记(10) ——搭建源码学习环境上一章中,我们对整个hadoop的目录及源码目录有了一个初步的了解,接下来计划深入学习一下这头神象作品了.但是看代码用什么,难不成gedit?,单步 ...

随机推荐

34.Odoo产品分析 (四) – 工具板块(5) – 设备及联系人目录(1)
查看Odoo产品分析系列--目录设备管理设备应用用于公司内部的设备管理,跟踪员工的设备及管理维护的要求. 安装"设备"模块: 1 设备选择设备菜单,并新建一个设备,该表单 ...
OkHttp的封装和使用详解
Github地址 compile 'cn.yuan.yu:library:1.0.2' 第一步:初始化我们的工具类 public class MyApplication extends Applica ...
(办公)重新选择一个开发工具Eclipse
文章Eclipse内容摘抄自w3cschool的eclipse,原文地址:https://www.w3cschool.cn/eclipse/eclipse-run-configuration.html ...
移动Web前端，游客点击商品的收藏按钮，登录完成，回来之后，如何自动收藏
我们都知道,移动Web端(M站环境下),很多时候,前端是无法判断用户的登录状态的,因为出于安全性考虑,与账号相关的cookie字段一般都是 http-only的. 如果前端想判断用户的登录状态,需要主 ...
VS错误：#error 指令: Please use the /MD switch for _AFXDLL builds
我在做MFC时遇到过这个问题,解决方法如下: 修改设置:工程(Project)-> 属性(Properties)-> 配置属性(Configuration Properties)-> ...
HashMap和Hashtable的同和不同（详细比较）
一.综述可以直接根据hashcode值判断两个对象是否相等吗?肯定是不可以的,因为不同的对象可能会生成相同的hashcode值.虽然不能根据hashcode值判断两个对象是否相等,但是可以直接根据h ...
C#面向对象类的封装
class student { public int _code; public int Code//属性 { //获取值 get { ; } //设置值 set { _code = value + ...
mssql sql server 其它系统函数 parsename 点语法字符串分割函数应用简介
转自:http://www.maomao365.com/?p=4534 一. parsename函数功能简介 parsename函数的主要功能是:可以快速的使用”.”关键字分解字符串,并返回.分解后指 ...
window scoop 修改默认安装路径
1.运行powershell [environment]::setEnvironmentVariable('SCOOP_GLOBAL','F:\GlobalScoopApps','Machine') ...
python 中文报错
解决的办法为:在程序的开头写入如下代码,这就是中文注释 #coding=utf-8

hadoop学习笔记叁--简单应用

hadoop学习笔记叁--简单应用的更多相关文章

随机推荐

热门专题