hadoop的hdfs中的javaAPI操作

package cn.itcast.bigdata.hdfs;

import java.net.URI;

import java.util.Iterator;

import java.util.Map.Entry;

import org.apache.hadoop.conf.Configuration;

import org.apache.hadoop.fs.FileStatus;

import org.apache.hadoop.fs.FileSystem;

import org.apache.hadoop.fs.LocatedFileStatus;

import org.apache.hadoop.fs.Path;

import org.apache.hadoop.fs.RemoteIterator;

import org.junit.Before;

import org.junit.Test;

/**

 *

 * 客户端去操作hdfs时，是有一个用户身份的

 * 默认情况下，hdfs客户端api会从jvm中获取一个参数来作为自己的用户身份：-DHADOOP_USER_NAME=hadoop

 *

 * 也可以在构造客户端fs对象时，通过参数传递进去

 * @author

 *

 */

public class HdfsClientDemo {

    FileSystem fs = null;

    Configuration conf = null;

    @Before

    public void init() throws Exception{

        conf = new Configuration();

        conf.set("fs.defaultFS", "hdfs://master:9000");

        //拿到一个文件系统操作的客户端实例对象

        /*fs = FileSystem.get(conf);*/

        //可以直接传入 uri和用户身份

        fs = FileSystem.get(new URI("hdfs://master:9000"),conf,"hadoop"); //最后一个参数为用户名

    }

    @Test

    public void testUpload() throws Exception {

        Thread.sleep(2000);

        fs.copyFromLocalFile(new Path("G:/access.log"), new Path("/access.log.copy"));

        fs.close();

    }

    @Test

    public void testDownload() throws Exception {

        fs.copyToLocalFile(new Path("/access.log.copy"), new Path("d:/"));

        fs.close();

    }

    @Test

    public void testConf(){

        Iterator<Entry<String, String>> iterator = conf.iterator();

        while (iterator.hasNext()) {

            Entry<String, String> entry = iterator.next();

            System.out.println(entry.getValue() + "--" + entry.getValue());//conf加载的内容

        }

    }

    /**

     * 创建目录

     */

    @Test

    public void makdirTest() throws Exception {

        boolean mkdirs = fs.mkdirs(new Path("/aaa/bbb"));

        System.out.println(mkdirs);

    }

    /**

     * 删除

     */

    @Test

    public void deleteTest() throws Exception{

        boolean delete = fs.delete(new Path("/aaa"), true);//true， 递归删除

        System.out.println(delete);

    }

    @Test

    public void listTest() throws Exception{

        FileStatus[] listStatus = fs.listStatus(new Path("/"));

        for (FileStatus fileStatus : listStatus) {

            System.err.println(fileStatus.getPath()+"================="+fileStatus.toString());

        }

        //会递归找到所有的文件

        RemoteIterator<LocatedFileStatus> listFiles = fs.listFiles(new Path("/"), true);

        while(listFiles.hasNext()){

            LocatedFileStatus next = listFiles.next();

            String name = next.getPath().getName();

            Path path = next.getPath();

            System.out.println(name + "---" + path.toString());

        }

    }

    public static void main(String[] args) throws Exception {

        Configuration conf = new Configuration();

        conf.set("fs.defaultFS", "hdfs://master:9000");

        //拿到一个文件系统操作的客户端实例对象

        FileSystem fs = FileSystem.get(conf);

        fs.copyFromLocalFile(new Path("G:/access.log"), new Path("/access.log.copy"));

        fs.close();

    }

}

package cn.itcast.bigdata.hdfs;

import java.net.URI;

import java.util.Iterator;

import java.util.Map.Entry;

import org.apache.hadoop.conf.Configuration;

import org.apache.hadoop.fs.FileStatus;

import org.apache.hadoop.fs.FileSystem;

import org.apache.hadoop.fs.LocatedFileStatus;

import org.apache.hadoop.fs.Path;

import org.apache.hadoop.fs.RemoteIterator;

import org.junit.Before;

import org.junit.Test;

/**

 *

 * 客户端去操作hdfs时，是有一个用户身份的

 * 默认情况下，hdfs客户端api会从jvm中获取一个参数来作为自己的用户身份：-DHADOOP_USER_NAME=hadoop

 *

 * 也可以在构造客户端fs对象时，通过参数传递进去

 * @author

 *

 */

public class HdfsClientDemo {

    FileSystem fs = null;

    Configuration conf = null;

    @Before

    public void init() throws Exception{

        conf = new Configuration();

        conf.set("fs.defaultFS", "hdfs://master:9000");

        //拿到一个文件系统操作的客户端实例对象

        /*fs = FileSystem.get(conf);*/

        //可以直接传入 uri和用户身份

        fs = FileSystem.get(new URI("hdfs://master:9000"),conf,"hadoop"); //最后一个参数为用户名

    }

    @Test

    public void testUpload() throws Exception {

        Thread.sleep(2000);

        fs.copyFromLocalFile(new Path("G:/access.log"), new Path("/access.log.copy"));

        fs.close();

    }

    @Test

    public void testDownload() throws Exception {

        fs.copyToLocalFile(new Path("/access.log.copy"), new Path("d:/"));

        fs.close();

    }

    @Test

    public void testConf(){

        Iterator<Entry<String, String>> iterator = conf.iterator();

        while (iterator.hasNext()) {

            Entry<String, String> entry = iterator.next();

            System.out.println(entry.getValue() + "--" + entry.getValue());//conf加载的内容

        }

    }

    /**

     * 创建目录

     */

    @Test

    public void makdirTest() throws Exception {

        boolean mkdirs = fs.mkdirs(new Path("/aaa/bbb"));

        System.out.println(mkdirs);

    }

    /**

     * 删除

     */

    @Test

    public void deleteTest() throws Exception{

        boolean delete = fs.delete(new Path("/aaa"), true);//true， 递归删除

        System.out.println(delete);

    }

    @Test

    public void listTest() throws Exception{

        FileStatus[] listStatus = fs.listStatus(new Path("/"));

        for (FileStatus fileStatus : listStatus) {

            System.err.println(fileStatus.getPath()+"================="+fileStatus.toString());

        }

        //会递归找到所有的文件

        RemoteIterator<LocatedFileStatus> listFiles = fs.listFiles(new Path("/"), true);

        while(listFiles.hasNext()){

            LocatedFileStatus next = listFiles.next();

            String name = next.getPath().getName();

            Path path = next.getPath();

            System.out.println(name + "---" + path.toString());

        }

    }

    public static void main(String[] args) throws Exception {

        Configuration conf = new Configuration();

        conf.set("fs.defaultFS", "hdfs://master:9000");

        //拿到一个文件系统操作的客户端实例对象

        FileSystem fs = FileSystem.get(conf);

        fs.copyFromLocalFile(new Path("G:/access.log"), new Path("/access.log.copy"));

        fs.close();

    }

}

hadoop的hdfs中的javaAPI操作的更多相关文章

Hadoop基础-HDFS的API常见操作
Hadoop基础-HDFS的API常见操作作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 本文主要是记录一写我在学习HDFS时的一些琐碎的学习笔记, 方便自己以后查看.在调用API ...
HDFS文件系统的JAVA-API操作(一)
使用java.net.URL访问HDFS文件系统 HDFS的API使用说明: 1.如果要访问HDFS,HDFS客户端必须有一份HDFS的配置文件也就是hdfs-site.xml,从而读取Nameno ...
Hadoop学习-hdfs安装及其一些操作
hdfs:分布式文件系统有目录结构,顶层目录是: /,存的是文件,把文件存入hdfs后,会把这个文件进行切块并且进行备份,切块大小和备份的数量有客户决定. 存文件的叫datanode,记录文件的切 ...
Hadoop架构: HDFS中数据块的状态及其切换过程，GS与BGS
该系列总览: Hadoop3.1.1架构体系——设计原理阐述与Client源码图文详解 : 总览首先,我们要提出HDFS存储特点: 1.高容错 2.一个文件被切成块(新版本默认128MB一个块)在不 ...
Hadoop(7)-HDFS客户端的API操作
1 客户端环境准备根据自己电脑的操作系统拷贝对应的编译后的hadoop jar包到非中文路径配置HADOOP_HOME的环境变量,并且在path中配置hadoop的bin 重启电脑 2. Hdfs ...
hadoop的hdfs中的namenode和datanode知识总结
一,NameNode: 1, Namenode是中心服务器,单一节点(简化系统的设计和实现),负责管理文件系统的名称空间(namespace)以及客户端对文件的访问. 2, 文件操作,Namenod ...
HDFS的基本shell操作，hadoop fs操作命令
(1)分布式文件系统随着数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是不方便管理和维护,因此迫切需要一种系统来管理多台机器上的文件,这就是分布式文件管 ...
[转]HDFS中JAVA API的使用
HDFS是一个分布式文件系统,既然是文件系统,就可以对其文件进行操作,比如说新建文件.删除文件.读取文件内容等操作.下面记录一下使用JAVA API对HDFS中的文件进行操作的过程. 对分HDFS中的 ...
HDFS中JAVA API的使用
HDFS中JAVA API的使用 HDFS是一个分布式文件系统,既然是文件系统,就可以对其文件进行操作,比如说新建文件.删除文件.读取文件内容等操作.下面记录一下使用JAVA API对HDFS中的 ...

随机推荐

.net core webapi带权限的文件下载方法
众所周知,在webapi中,如果有个接口需要权限,一般会将带权限的字段塞进header中.但是,在带权限的文档下载接口中,无论是用post,还是get方式,我们无法设置header头信息.苦恼呀?别急 ...
使用GraphHttpClient调用Microsoft Graph接口 - PATCH
博客地址:http://blog.csdn.net/FoxDave 通过前两讲的阐述我们应该大致了解了使用GraphHttpClient调用Microsoft Graph接口的模式,并介绍了使用get ...
Python:从入门到实践--第十章--文件和异常--练习
#.python学习笔记:在文本编辑器中新创建一个文件,写几句话老总结你至此学到的python知识 #其中‘In Python you can’ 打头.将这个文件命名为learning_python. ...
linux 极限环境下编译环境的安装
前文:通常情况下在linux系统中安装一个软件包或者是服务有几种方式. 最简单的一种是在可以连接外网的情况下,配置好网络yum源,需要什么包就配置什么yum然后一路yum install 软件包名即可 ...
Google - Reconstruct To Chain
/* 4. 给你一串input,比如: A -> B B -> C X -> Y Z -> X . . . 然后让你设计一个data structure来存这些关系,最后读完了 ...
代码本色用编程模拟自然系统（Daniel Shiffman 著)
https://cdnjs.cloudflare.com/ajax/libs/p5.js/0.5.7/p5.js http://www.box2d.org http://www.jbox2d.org ...
GanttProject 项目管理软件的优点
GanttProject 的优点 GanttProject 是一款基于 GPL 协议的开源软件,代码完全开源,使用的是 Java 语言编写. 最近在试用,有以下一些优大. 文件格式为 xml,这个是我 ...
linux查看进程启动的时间点
ps -ef |grep xxx # 先查找进程pid ps -wo pid,lstart -p {pid}
mac os high sierra下搭建php多版本-php5.2+php5.6-nginx
xampp的apache彻底启动不来了. php52的编译参数 ./configure --prefix=/usr/local/Cellar/php52bysk/ --with-config-file ...
【java】模板方法设计模式
模板方法:在定义功能时,功能一部分是确认的,另一部分是不确认的或者后续会变化的.这时可以把不确定的部分暴露出去,定义成抽象类或者接口,由子类来完成. abstract class GetDuring ...

hadoop的hdfs中的javaAPI操作

hadoop的hdfs中的javaAPI操作的更多相关文章

随机推荐

热门专题