使用java api操作HDFS文件

实现的代码如下：

     import java.io.IOException;

     import java.net.URI;

     import java.net.URISyntaxException;  

     import org.apache.hadoop.conf.Configuration;

     import org.apache.hadoop.fs.FSDataInputStream;

     import org.apache.hadoop.fs.FSDataOutputStream;

     import org.apache.hadoop.fs.FileStatus;

     import org.apache.hadoop.fs.FileSystem;

     import org.apache.hadoop.fs.FileUtil;

     import org.apache.hadoop.fs.Path;

     import org.apache.hadoop.io.IOUtils;  

     public class HDFSTest {  

         //在指定位置新建一个文件，并写入字符

         public static void WriteToHDFS(String file, String words) throws IOException, URISyntaxException

         {

             Configuration conf = new Configuration();

             FileSystem fs = FileSystem.get(URI.create(file), conf);

             Path path = new Path(file);

             FSDataOutputStream out = fs.create(path);   //创建文件  

             //两个方法都用于文件写入，好像一般多使用后者

             out.writeBytes(words);

             out.write(words.getBytes("UTF-8"));  

             out.close();

             //如果是要从输入流中写入，或是从一个文件写到另一个文件（此时用输入流打开已有内容的文件）

             //可以使用如下IOUtils.copyBytes方法。

             //FSDataInputStream in = fs.open(new Path(args[0]));

             //IOUtils.copyBytes(in, out, 4096, true)        //4096为一次复制块大小，true表示复制完成后关闭流

         }  

         public static void ReadFromHDFS(String file) throws IOException

         {

             Configuration conf = new Configuration();

             FileSystem fs = FileSystem.get(URI.create(file), conf);

             Path path = new Path(file);

             FSDataInputStream in = fs.open(path);  

             IOUtils.copyBytes(in, System.out, 4096, true);

             //使用FSDataInoutStream的read方法会将文件内容读取到字节流中并返回

             /**

              * FileStatus stat = fs.getFileStatus(path);

           // create the buffer

            byte[] buffer = new byte[Integer.parseInt(String.valueOf(stat.getLen()))];

            is.readFully(0, buffer);

            is.close();

                  fs.close();

            return buffer;

              */

         }  

         public static void DeleteHDFSFile(String file) throws IOException

         {

             Configuration conf = new Configuration();

             FileSystem fs = FileSystem.get(URI.create(file), conf);

             Path path = new Path(file);

             //查看fs的delete API可以看到三个方法。deleteonExit实在退出JVM时删除，下面的方法是在指定为目录是递归删除

             fs.delete(path,true);

             fs.close();

         }  

         public static void UploadLocalFileHDFS(String src, String dst) throws IOException

         {

             Configuration conf = new Configuration();

             FileSystem fs = FileSystem.get(URI.create(dst), conf);

             Path pathDst = new Path(dst);

             Path pathSrc = new Path(src);  

             fs.copyFromLocalFile(pathSrc, pathDst);

             fs.close();

         }  

         public static void ListDirAll(String DirFile) throws IOException

         {

             Configuration conf = new Configuration();

             FileSystem fs = FileSystem.get(URI.create(DirFile), conf);

             Path path = new Path(DirFile);  

             FileStatus[] status = fs.listStatus(path);

             //方法1

             for(FileStatus f: status)

             {

                 System.out.println(f.getPath().toString());

             }

             //方法2

             Path[] listedPaths = FileUtil.stat2Paths(status);

             for (Path p : listedPaths){

               System.out.println(p.toString());

             }

         }  

         public static void main(String [] args) throws IOException, URISyntaxException

         {

             //下面做的是显示目录下所有文件

             ListDirAll("hdfs://ubuntu:9000/user/kqiao");  

             String fileWrite = "hdfs://ubuntu:9000/user/kqiao/test/FileWrite";

             String words = "This words is to write into file!\n";

             WriteToHDFS(fileWrite, words);

             //这里我们读取fileWrite的内容并显示在终端

             ReadFromHDFS(fileWrite);

             //这里删除上面的fileWrite文件

             DeleteHDFSFile(fileWrite);

             //假设本地有一个uploadFile，这里上传该文件到HDFS

     //      String LocalFile = "file:///home/kqiao/hadoop/MyHadoopCodes/uploadFile";

     //      UploadLocalFileHDFS(LocalFile, fileWrite    );

         }

     }

FSDataOutputStream os = hdfs.create(new Path(args[0]));

注意：在os.flush() 刷新数据流；

有时写入的文件不能立即被其他读者看见，只有大于一个块时其他读者才能看见第一个块，但还是不能看见当前块。可以使用out.sync() 强制所有缓存与数据节点同步。其实在每一个os.close()中隐含了一个sync()的调用。

使用java api操作HDFS文件的更多相关文章

JAVA API 实现hdfs文件操作
java api 实现hdfs 文件操作会出现错误提示: Permission denied: user=hp, access=WRITE, inode="/":hdfs:supe ...
使用Java API操作HDFS文件系统
使用Junit封装HFDS import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.*; import org ...
使用Java Api 操作HDFS
如题我就是一个标题党就是使用JavaApi操作HDFS,使用的是MAVEN,操作的环境是Linux 首先要配置好Maven环境,我使用的是已经有的仓库,如果你下载的jar包速度慢,可以改变Ma ...
Hadoop Java API操作HDFS文件系统（Mac）
1.下载Hadoop的压缩包 tar.gz https://mirrors.tuna.tsinghua.edu.cn/apache/hadoop/common/stable/ 2.关联jar包在 ...
hadoop学习笔记（五）：java api 操作hdfs
HDFS的Java访问接口 1)org.apache.hadoop.fs.FileSystem 是一个通用的文件系统API,提供了不同文件系统的统一访问方式. 2)org.apache.hadoop. ...
java Api 读取HDFS文件内容
package dao; import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.fs.*; import java ...
用java api读取HDFS文件
import java.io.IOException; import java.io.InputStream; import java.security.PrivilegedExceptionActi ...
Hadoop之HDFS（三）HDFS的JAVA API操作
HDFS的JAVA API操作 HDFS 在生产应用中主要是客户端的开发,其核心步骤是从 HDFS 提供的 api中构造一个 HDFS 的访问客户端对象,然后通过该客户端对象操作(增删改查)HDFS ...
HDFS 05 - HDFS 常用的 Java API 操作
目录 0 - 配置 Hadoop 环境(Windows系统) 1 - 导入 Maven 依赖 2 - 常用类介绍 3 - 常见 API 操作 3.1 获取文件系统(重要) 3.2 创建目录.写入文件 ...

随机推荐

HDU - 4420 2013icpc长春A 函数离散化 + st表
思路:我们定义F(x) 为以x点为起点,向后(a - b)个里面有多少个白球,虽然x的范围是LL范围内的,但是白球的个数只有1e5, 那么我们可以把连续一段相同的离散化到一起, 对于一个确定的长度为 ...
Codeforces Round #334 (Div. 1) B. Moodular Arithmetic
B - Moodular Arithmetic 题目大意:题意:告诉你p和k,其中(0<=k<=p-1),x属于{0,1,2,3,....,p-1},f函数要满足f(k*x%p)=k*f( ...
Django实战（4）：scaffold生成物分析
在上一节用一个插件生成了类似rails的scaffold,其实无非就是URLconf+MTV.让我们看看具体都生成了哪些东西. 首先是“入口”的定义即URLconf,打开urls.py: from d ...
poi类包对比
海康威视 - 萤石云开放平台 js 版
开放平台 https://open.ys7.com/mobile/download.html API http://open.ys7.com/doc/zh/uikit/uikit_javascript ...
bzoj——2127: happiness
2127: happiness Time Limit: 51 Sec Memory Limit: 259 MBSubmit: 2570 Solved: 1242[Submit][Status][D ...
awk 基本函数用法
gsub函数有点类似于sed查找和替换.它允许替换一个字符串或字符为另一个字符串或字符,并以正则表达式的形式执行.第一个函数作用于记录$0,第二个gsub函数允许指定目标,然而,如果未指定目标,缺省为 ...
Here is a 10-line template that can solve most 'substring' problems子字符串问题的模板
转载自leetcode评论区:https://discuss.leetcode.com/topic/30941/here-is-a-10-line-template-that-can-solve-mo ...
bzoj 3283 扩展BSGS + 快速阶乘
T2 扩展BSGS T3 快速阶乘给定整数n,质数p和正整数c,求整数s和b,满足n! / pb = s mod pc 考虑每次取出floor(n/p)个p因子,然后将问题转化为子问题. /*** ...
RTSP交互过程
步骤一: 发送:OPTIONS rtsp://127.0.0.1/172.30.31.225:8000:HIK-DS8000HC:0:1:admin:hs123456:av_stream RTSP/1 ...

使用java api操作HDFS文件

使用java api操作HDFS文件的更多相关文章

随机推荐

热门专题