HDFS基础1
一、HDFS入门

二、HDFS基本操作
1、shell命令行客户端
Hadoop提供了文件系统的shell命令行客户端,使用方法如下:
Hadoop fs <args>(参数哪一个文件系统和什么样的操作)
文件系统shell包括与Hadoop分布式文件系统(HDFS)以及Hadoop支持的其他文件系统(如本地FS, HFTP FS, S3 FS等)直接交互的各种类似shell的命令。所有FS shell命令都将路径URI作为参数
URI格式为scheme://suthority/path。
对于HDFS来说:scheme是hdfs;
对于本地FS来说:scheme是file
scheme和authority是可选的,如果未指定,则使用配置中指定的默认方案
对于HDFS,命令示例如下:
Hadoop fs -ls hdfs://namenode:host/parent/child
Hadoop fs -ls /parent/child fs.defaultFS中有配置
对于本地文件系统命令示例如下
Hadoop fs -ls file:///root
如果使用的文件系统是HDFS,则使用hdfs dfs也是可以的,此时
Hadoop fs <args> = hdfs dfs <args>
三、shell常用命令
1、-ls
功能:
显示文件、目录信息
使用:
hadoop fs -ls [-h](human给大小加上了单位) <args>
示例:
hadoop fs -ls /hello
hadoop fs -ls -h /hello

2、-mkdir
功能:
在hdfs上创建目录,-p表示会创建路径中的各级父目录。
使用:
hadoop fs -mkdir [-p] <paths>
示例:
hadoop fs -mkdir -p /hello/hello1/hello2

3、-put
功能:
将单个文件或多个文件从本地文件系统复制(上传)到目标文件系统
使用:
hadoop fs -put [-f] [-p] 本地文件目录 目标文件目录
-p:表示保留访问和修改时间,所有权和权限
-f:覆盖目的地(如果已经存在)
示例:
hadoop fs -put /root/install.log.syslog /

4、-get
功能:
将文件复制(下载)到本地文件系统
使用:
hadoop fs -get [ignorecrc] [-crc] [-p] [-f] 文件系统目录 本地文件保 存目录
-ignorecrc:跳过对下载文件的CRC检查
-crc:为下载的文件写CRC效验和
示例:
hadoop fs -get /install.log.syslog ./(当前目录)

5、-appendToFile
功能:
追加一个文件到已经存在的文件末尾
使用:
hadoop fs -appendToFile 本地文件目录 目标文件目录
示例:
hadoop fs -appendToFile 2.txt /1.txt
6、-cat
功能:
显示文件内容
使用:
hadoop fs -cat 文件目录
示例:
hadoop fs -cat /1.txt

7、-tail
功能:
查看文件的最后一千字内容
使用:
hadoop fs -tail [-f] 目录
示例:
hadoop fs -tail /hadoop/hadoopfile
8、-getmerge
功能:
合并下在多个文件
示例:
比如hdfs目录 /aaa下多个文件:log.1, log.12, log.3
Hadoop fs -getmerge /aaa/log.* ./log.sum
9、-setrep
功能:改变一个文件的副本系数。-R 选项用于递归改变目录下所有文件的副本系数
示例:hadoop fs -setrep -w 3(副本个数) [-R(一个文件不用写)] /user/hadoop/dir1
HDFS基础1的更多相关文章
- Hadoop学习笔记—2.不怕故障的海量存储:HDFS基础入门
一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...
- 每天收获一点点------Hadoop之HDFS基础入门
一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...
- HDFS基础配置
HADOOP-3.1.0-----HDFS基础配置 执行步骤:(1)配置集群(2)启动.测试集群增.删.查(3)执行wordcount案例 一.配置集群 1.在 hadoop-env.sh配置文件添加 ...
- HDFS基础
1. HDFS Shell基础 [root@master hadoop]# hadoop fsUsage: hadoop fs [generic options] [-appendToFile < ...
- Hadoop学习之路(六)HDFS基础
HDFS前言 HDFS:Hadoop Distributed File System ,Hadoop分布式文件系统,主要用来解决海量数据的存储问题 设计思想 1.分散均匀存储 dfs.blocksiz ...
- Hadoop系列-HDFS基础
基本原理 HDFS(Hadoop Distributed File System)是Hadoop的一个基础的分布式文件系统,这个分布式的概念主要体现在两个地方: 数据分块存储在多台主机 数据块采取冗余 ...
- Hadoop学习之路(二)HDFS基础
1.HDFS前言 HDFS:Hadoop Distributed File System,Hadoop分布式文件系统,主要用来解决海量数据的存储问题. 设计思想 分散均匀存储 dfs.blocksiz ...
- HDFS基础和java api操作
1. 概括 适合一次写入多次查询情况,不支持并发写情况 通过hadoop shell 上传的文件存放在DataNode的block中,通过linux shell只能看见block,看不见文件(HDFS ...
- hadoop - hdfs 基础操作
hdfs --help # 所有参数 hdfs dfs -help # 运行文件系统命令在Hadoop文件系统 hdfs dfs -ls /logs # 查看 hdfs dfs -ls /user/ ...
随机推荐
- Vue 组件异步加载(懒加载)
一.vue的编译模式 (1)路由配置信息 //eg1: const MSite = resolve => require.ensure([], () =>resolve(require([ ...
- Java源码阅读顺序
阅读顺序参考链接:https://blog.csdn.net/qq_21033663/article/details/79571506 阅读源码:JDK 8 计划阅读的package: 1.java. ...
- windows cmd 查找/关闭端口
1.首先查找端口,会显示出所有的端口,比如说要找到端口为“8888”的PID netstat -ano 2.还可以精确查找 netstat -aon|findstr " 3.关闭对应的端口 ...
- C# Thread IsAlive 理解
IsAlive的功能就是判断当前线程是否处于活动状态. public class Program { public static void Main(string[] args) { try { Wr ...
- asp.netajax与jquery和bootstrap的无刷新完美实现
20190421asp.netajax与jquery和bootstrap的无刷新完美实现 设计代码和后台代码中重要部分加粗和深色以及字号加大. 设计前台代码: <%@ Page Title=&q ...
- 花了几天学习了vue跟做的仿制app
Vue.js国内开发者 是用于构建交互式的 Web 界面的库.它提供了mvvm 数据绑定和一个可组合的组件系统,具有简单.灵活的 API.从技术上讲, Vue.js 集中在 mvvm 模式上的视图模 ...
- cordova/phonegap/webapp性能优化方法
1.有条件可以自己做UI,不要用框架.用框架的话不要用jquery mobile,用sencha touch或者jqmobi(app framework) 2.不要在服务器生成UI,在本地生成. 3. ...
- flask基础--第二篇
1.Flask中的HTTPResponse,Redirect, render #导入render_template和redirect from flask import Flask,render_te ...
- JS变量的提升详解
此次说明的是var与function的变量提升 那么先看一段代码 <script type="text/javascript"> console.log(test); ...
- 异常java.lang.NumberFormatException解决
原因一:超出了int类型的取值范围 项目中要把十六进制字符串转化为十进制, 用到了到了Integer.parseInt(str1.trim(), 16):这个是不是后抛出java.lang.Numbe ...