一、HDFS入门

二、HDFS基本操作

1、shell命令行客户端

Hadoop提供了文件系统的shell命令行客户端,使用方法如下:

Hadoop fs <args>(参数哪一个文件系统和什么样的操作)

文件系统shell包括与Hadoop分布式文件系统(HDFS)以及Hadoop支持的其他文件系统(如本地FS,  HFTP FS, S3 FS等)直接交互的各种类似shell的命令。所有FS shell命令都将路径URI作为参数

URI格式为scheme://suthority/path。

对于HDFS来说:scheme是hdfs;

对于本地FS来说:scheme是file

scheme和authority是可选的,如果未指定,则使用配置中指定的默认方案

对于HDFS,命令示例如下:

Hadoop fs -ls hdfs://namenode:host/parent/child

Hadoop fs -ls /parent/child    fs.defaultFS中有配置

对于本地文件系统命令示例如下

Hadoop fs -ls file:///root

如果使用的文件系统是HDFS,则使用hdfs dfs也是可以的,此时

Hadoop fs <args> = hdfs dfs <args>

三、shell常用命令

1、-ls

功能:

显示文件、目录信息

使用:

hadoop  fs  -ls  [-h](human给大小加上了单位)  <args>

示例:

hadoop  fs  -ls  /hello

hadoop  fs  -ls  -h  /hello

2、-mkdir

功能:

在hdfs上创建目录,-p表示会创建路径中的各级父目录。

使用:

hadoop fs -mkdir [-p] <paths>

示例:

hadoop fs -mkdir -p /hello/hello1/hello2

3、-put

功能:

将单个文件或多个文件从本地文件系统复制(上传)到目标文件系统

使用:

hadoop  fs  -put  [-f]  [-p] 本地文件目录 目标文件目录

-p:表示保留访问和修改时间,所有权和权限

-f:覆盖目的地(如果已经存在)

示例:

hadoop  fs  -put  /root/install.log.syslog  /

4、-get

功能:

将文件复制(下载)到本地文件系统

使用:

hadoop  fs  -get  [ignorecrc]  [-crc]  [-p]  [-f]  文件系统目录 本地文件保 存目录

-ignorecrc:跳过对下载文件的CRC检查

-crc:为下载的文件写CRC效验和

示例:

hadoop  fs -get  /install.log.syslog  ./(当前目录)

5、-appendToFile

功能:

追加一个文件到已经存在的文件末尾

使用:

hadoop  fs  -appendToFile  本地文件目录 目标文件目录

示例:

hadoop  fs  -appendToFile 2.txt  /1.txt

6、-cat

功能:

显示文件内容

使用:

hadoop  fs  -cat 文件目录

示例:

hadoop  fs  -cat  /1.txt

7、-tail

功能:

查看文件的最后一千字内容

使用:

hadoop fs -tail [-f] 目录

示例:

hadoop fs -tail /hadoop/hadoopfile

8、-getmerge

功能:

合并下在多个文件

示例:

比如hdfs目录 /aaa下多个文件:log.1, log.12, log.3

Hadoop fs -getmerge  /aaa/log.*  ./log.sum

9、-setrep

功能:改变一个文件的副本系数。-R 选项用于递归改变目录下所有文件的副本系数

示例:hadoop fs -setrep -w 3(副本个数) [-R(一个文件不用写)]  /user/hadoop/dir1

HDFS基础1的更多相关文章

  1. Hadoop学习笔记—2.不怕故障的海量存储:HDFS基础入门

    一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...

  2. 每天收获一点点------Hadoop之HDFS基础入门

    一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...

  3. HDFS基础配置

    HADOOP-3.1.0-----HDFS基础配置 执行步骤:(1)配置集群(2)启动.测试集群增.删.查(3)执行wordcount案例 一.配置集群 1.在 hadoop-env.sh配置文件添加 ...

  4. HDFS基础

    1. HDFS Shell基础 [root@master hadoop]# hadoop fsUsage: hadoop fs [generic options] [-appendToFile < ...

  5. Hadoop学习之路(六)HDFS基础

    HDFS前言 HDFS:Hadoop Distributed File System ,Hadoop分布式文件系统,主要用来解决海量数据的存储问题 设计思想 1.分散均匀存储 dfs.blocksiz ...

  6. Hadoop系列-HDFS基础

    基本原理 HDFS(Hadoop Distributed File System)是Hadoop的一个基础的分布式文件系统,这个分布式的概念主要体现在两个地方: 数据分块存储在多台主机 数据块采取冗余 ...

  7. Hadoop学习之路(二)HDFS基础

    1.HDFS前言 HDFS:Hadoop Distributed File System,Hadoop分布式文件系统,主要用来解决海量数据的存储问题. 设计思想 分散均匀存储 dfs.blocksiz ...

  8. HDFS基础和java api操作

    1. 概括 适合一次写入多次查询情况,不支持并发写情况 通过hadoop shell 上传的文件存放在DataNode的block中,通过linux shell只能看见block,看不见文件(HDFS ...

  9. hadoop - hdfs 基础操作

    hdfs --help # 所有参数 hdfs dfs -help # 运行文件系统命令在Hadoop文件系统 hdfs dfs -ls /logs # 查看 hdfs dfs -ls /user/ ...

随机推荐

  1. Shovel Sale CodeForces - 899D (数位dp)

    大意: n把铲子, 价格1,2,3,...n, 求有多少个二元组(x,y), 满足x+y末尾数字9的个数最多. 枚举最高位, 转化为从[1,n]中选出多少个二元组和为$x$, 枚举较小的数 若$n\g ...

  2. Vue非父子级通信

    <div id="app"> <xz-todo></xz-todo> </div> <!--1. 为每个组件定义HTML 模板 ...

  3. C#数组--(一维数组,二维数组的声明,使用及遍历)

    数组:是具有相同数据类型的一组数据的集合.数组的每一个的变量称为数组的元素,数组能够容纳元素的数称为数组的长度. 一维数组:以线性方式存储固定数目的数组元素,它只需要1个索引值即可标识任意1个数组元素 ...

  4. angular 引入ocLazyLoad实现js、controller懒加载

    项目之前是直接在index.html中引用了controller.js,其中包含了所有的controller.现引入ocLazyLoad实现按需加载,到指定页面再加载指定js.controller 1 ...

  5. 2019.3.16数据结构考试(Problem 1. rotinv)(循环逆序对)

    Problem 1. rotinvInput file: rotinv.inOutput file: rotinv.outTime limit: 2 secondsMemory limit: 256 ...

  6. nodejs常见问题

    Js 基础问题 与前端 Js 不同, 后端是直面服务器的, 更加偏向内存方面. [Basic] 类型判断    [Basic] 作用域    [Basic] 引用传递    [Basic] 内存释放  ...

  7. 如何正确可视化RAW(ARW,DNG,raw等格式)图像?

    为了正确可视化RAW图像,需要做好:白平衡.提亮以及色彩映射. import numpy as np import struct from PIL import Image import rawpy ...

  8. MHA实现MySQL的高可用

    一:软件简介 MHA(Master High Availability)目前在MySQL高可用方面是一个相对成熟的解决方案,是一套优秀的作为MySQL高可用性环境下故障切换和主从提升的高可用软件. 在 ...

  9. Git常用命令及使用,GitLab/GitHub初探,Git/Svn区别

    Git安装配置及常用命令 0 Git本地分支管理 1 Git远程分支管理 2 Git Tag标签管理 3 Git Log日志 4 其它高级命令 5 常规使用及介绍 6 角色权限 7 分支定义 8 一般 ...

  10. Android平台上的Aplay与TinyAlsa移植使用

    ALSA是高级Linux声音架构.提供了一系列音频的逻辑接口,包括PCM.CONTROL等.这些,不影响它的使用,了解一下就可以. 在Android设备上,linux 2.x的版本,要控制录制播放音频 ...