用法





    -mkdir
    创建目录
    Usage:hdfs dfs -mkdir [-p] < paths>
    选项:-p
    很像Unix mkdir -p,沿路径创建父目录。

    -ls
    查看目录下内容,包括文件名,权限,所有者,大小和修改时间
    Usage:hdfs dfs -ls [-R] < args>
    选项:-R
    递归地显示子目录下的内容
   

    -put
    将本地文件或目录上传到HDFS中的路径
    Usage:hdfs dfs -put < localsrc> … < dst>



    -get
    将文件或目录从HDFS中的路径拷贝到本地文件路径
    Usage:hdfs dfs -get [-ignoreCrc] [-crc] < src> < localdst>
    选项:
    -ignorecrc选项复制CRC校验失败的文件。
    -crc选项复制文件和CRC。


  

    -du
    显示给定目录中包含的文件和目录的大小或文件的长度,用字节大小表示,文件名用完整的HDFS协议前缀表示,以防它只是一个文件。
    Usage:hdfs dfs -du [-s] [-h] URI [URI …]
    选项:
    -s选项将显示文件长度的汇总摘要,而不是单个文件。
    -h选项将以“人类可读”的方式格式化文件大小(例如64.0m而不是67108864)
   

    -dus
    显示文件长度的摘要。
    Usage:hdfs dfs -dus < args>
    注意:不推荐使用此命令。而是使用hdfs dfs -du -s。
 

    -mv
    在HDFS文件系统中,将文件或目录从HDFS的源路径移动到目标路径。不允许跨文件系统移动文件。
    Usage: hdfs dfs -mv URI [URI …] < dest>
   

    -cp
    在HDFS文件系统中,将文件或目录复制到目标路径下
    Usage:hdfs dfs -cp [-f] [-p | -p [topax] ] URI [ URI …] < dest>
    选项:
    -f选项覆盖已经存在的目标。
    -p选项将保留文件属性[topx](时间戳,所有权,权限,ACL,XAttr)。如果指定了-p且没有arg,则保留时间戳,所有权和权限。如果指定了-pa,则还保留权限,因为ACL是一组超级权限。确定是否保留原始命名空间扩展属性与-p标志无关。
   

    -copyFromLocal
    从本地复制文件到hdfs文件系统(与-put命令相似)
    Usage: hdfs dfs -copyFromLocal < localsrc> URI
    选项:
    如果目标已存在,则-f选项将覆盖目标。

    -copyToLocal
    复制hdfs文件系统中的文件到本地 (与-get命令相似)
    Usage: hdfs dfs -copyToLocal [-ignorecrc] [-crc] URI < localdst>

    -rm
    删除一个文件或目录
    Usage:hdfs dfs -rm [-f] [-r|-R] [-skipTrash] URI [URI …]
    选项:
    如果文件不存在,-f选项将不显示诊断消息或修改退出状态以反映错误。
    -R选项以递归方式删除目录及其下的任何内容。
    -r选项等效于-R。
    -skipTrash选项将绕过垃圾桶(如果已启用),并立即删除指定的文件。当需要从超配额目录中删除文件时,这非常有用。
   

    -cat
    显示文件内容到标准输出上。
    Usage:hdfs dfs -cat URI [URI …]
 

    -text
    Usage: hdfs dfs -text
    获取源文件并以文本格式输出文件。允许的格式为zip和TextRecordInputStream。

    -touchz
    创建一个零长度的文件。
    Usage:hdfs dfs -touchz URI [URI …]
  

    -stat
    显示文件所占块数(%b),文件名(%n),块大小(%n),复制数(%r),修改时间(%y%Y)。
    Usage:hdfs dfs -stat URI [URI …]

    -tail
    显示文件的最后1kb内容到标准输出
    Usage:hdfs dfs -tail [-f] URI
    选项:
    -f选项将在文件增长时输出附加数据,如在Unix中一样。

    -count
    统计与指定文件模式匹配的路径下的目录,文件和字节数
    Usage: hdfs dfs -count [-q] [-h] < paths>

    -getmerge
    将源目录和目标文件作为输入,并将src中的文件连接到目标本地文件(把两个文件的内容合并起来)
    Usage:hdfs dfs -getmerge < src> < localdst> [addnl]
    注:合并后的文件位于当前目录,不在hdfs中,是本地文件
   

    -grep
    从hdfs上过滤包含某个字符的行内容
    Usage:hdfs dfs -cat < srcpath> | grep 过滤字段
  

原文链接:https://blog.csdn.net/WQY992/article/details/89002269

Hadoop----hdfs dfs常用命令的使用的更多相关文章

  1. [b0002] Hadoop HDFS cmd常用命令练手

    目的: 学会HDFS CLI 常用操作 环境: Hadoop 2.6.4 伪分布式版 环境搭建参考本博客前篇文章: 伪分布式 hadoop 2.6.4 帮助: hadoop@ssmaster:~$ h ...

  2. Hadoop HDFS的常用命令

    1.将目录/root/data/下的item.txt复制到HDFS下的/user/root下: hadoop fs -copyFromLocal /root/data/item.txt itemdat ...

  3. Hadoop HDFS文件常用操作及注意事项

    Hadoop HDFS文件常用操作及注意事项 1.Copy a file from the local file system to HDFS The srcFile variable needs t ...

  4. Hadoop生态圈-hbase常用命令

    Hadoop生态圈-hbase常用命令 作者:尹正杰 版权声明:原创作品,谢绝转载!否则将追究法律责任.

  5. Hadoop HDFS的shell(命令行客户端)操作实例

    HDFS的shell(命令行客户端)操作实例 3.2 常用命令参数介绍 -help 功能:输出这个命令参数手册 -ls                  功能:显示目录信息 示例: hadoop fs ...

  6. hadoop/hdfs/yarn 详细命令搬运

    转载自文章 http://www.cnblogs.com/davidwang456/p/5074108.html 安装完hadoop后,在hadoop的bin目录下有一系列命令: container- ...

  7. Hadoop文件操作常用命令

    1.创建目录 #hdfs dfs -mkidr /test 2.查询目录结构 #hdfs dfs -ls / 子命令 -R递归查看//查看具体的某个目录:例如#hdfs dfs -ls /test 3 ...

  8. Hadoop HDFS文件常用操作及注意事项(更新)

    1.Copy a file from the local file system to HDFS The srcFile variable needs to contain the full name ...

  9. Hadoop生态圈-Kafka常用命令总结

    Hadoop生态圈-Kafka常用命令总结 作者:尹正杰 版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.管理Kafka服务的命令 1>.开启kafka服务 [yinzhengjie@s ...

随机推荐

  1. SpringBoot 集成Shiro之使用Redis缓存授权认证信息

    因为用户认证与授权需要从数据库中查询并验证信息,但是对于权限很少改变的情况,这样不断从数据库中查询角色验证权限,对整个系统的开销很大,对数据库压力也随之增大.因此可以将用户认证和授权信息都缓存起来,第 ...

  2. paramunittest参数化测试基础

    samples: import paramunittestimport unittest@paramunittest.parametrized( (10,20), (30,40), # (100,20 ...

  3. Hbase Region合并

    业务场景: Kafka+SparkStreaming+Hbase由于数据大量的迁移,再加上业务的改动,新增了很多表,导致rerigon总数接近4万(36个节点) 组件版本: Kafka:2.1.1 S ...

  4. 【Oracle】 并行查询

    所谓并行执行,是指能够将一个大型串行任务(任何DML,一般的DDL)物理的划分为叫多个小的部分,这些较小的部分可以同时得到处理.何时使用并行执行:1.必须有一个非常大的任务 2.必须有充足的资源(CP ...

  5. 洛谷P1972 [SDOI2009]HH的项链(树状数组)

    题目链接: https://www.luogu.org/problemnew/show/P1972 题目描述: HH 有一串由各种漂亮的贝壳组成的项链.HH 相信不同的贝壳会带来好运,所以每次散步完后 ...

  6. ctfhub技能树—sql注入—Cookie注入

    手注 打开靶机 查看页面信息 查找cookie 测试是否为cookie注入 抓包 尝试注入 成功查询到数据库名 查询表名 查询字段名 查询字段信息 成功拿到flag sqlmap 查询数据库名 pyt ...

  7. MySQL 5.6.35 索引优化导致的死锁案例解析

    一.背景 随着公司业务的发展,商品库存从商品中心独立出来成为一个独立的系统,承接主站商品库存校验.订单库存扣减.售后库存释放等业务.在上线之前我们对于核心接口进行了压测,压测过程中出现了 MySQL ...

  8. 扩展:Flash消息

    扩展:Flash消息 flash存值之后只能取一次 from flask import Flask,render_template,flash,get_flashed_messages,session ...

  9. Flask扩展点总结(信号)

    信号(源码) 信号,是在flask框架中为我们预留的钩子,让我们可以进行一些自定义操作. pip3 install blinker 根据flask项目的请求流程来进行设置扩展点 1.中间件 from ...

  10. vue2.0、vue3.0不同之处

    一.响应式赋值操作不同 Vue2.0 1.通过data返回对象做相应: 2.对复杂的对象或数组下的属性等深层次的改变需要通过$set的方式. Vue3.0 1.ref实现简单的实现响应,通过value ...