备战-Java IO

    君如载酒须尽醉,醉来不复思天涯。

简介:备战-Java IO。

一、概述

Java 的 I/O 大概可以分成以下几类:

  • 磁盘操作:File
  • 字节操作:InputStream 和 OutputStream
  • 字符操作:Reader 和 Writer
  • 对象操作:Serializable
  • 网络操作:Socket
  • 新的输入/输出:NIO

二、磁盘操作

File 类可以用于表示文件和目录的信息,但是它不表示文件的内容。

递归地列出一个目录下所有文件:

 1 public class QrController {
2 public static void main(String[] args) {
3 File file = new File("/TJT/code");
4 listAllFile(file);
5 }
6
7 public static void listAllFile(File dir){
8 if (!dir.exists() || dir == null){
9 return;
10 }
11 if (dir.isFile()){
12 System.out.println(dir.getName());
13 return;
14 }
15 for (File file : dir.listFiles()){
16 listAllFile(file);
17 }
18 }
19 }

从 Java7 开始,可以使用 Paths 和 Files 代替 File。

三、字节操作

实现文件复制

 1 public static void copyFile(String src, String dist) throws IOException {
2 FileInputStream in = new FileInputStream(src);
3 FileOutputStream out = new FileOutputStream(dist);
4
5 byte[] buffer = new byte[20 * 1024];
6 int cnt;
7
8 // read() 最多读取 buffer.length 个字节
9 // 返回的是实际读取的个数
10 // 返回 -1 的时候表示读到 eof,即文件尾
11 while ((cnt = in.read(buffer, 0, buffer.length)) != -1) {
12 out.write(buffer, 0, cnt);
13 }
14
15 in.close();
16 out.close();
17 }

装饰者模式

Java I/O 使用了装饰者模式来实现。以 InputStream 为例,

  • InputStream 是抽象组件;
  • FileInputStream 是 InputStream 的子类,属于具体组件,提供了字节流的输入操作;
  • FilterInputStream 属于抽象装饰者,装饰者用于装饰组件,为组件提供额外的功能。例如 BufferedInputStream 为 FileInputStream 提供缓存的功能。

实例化一个具有缓存功能的字节流对象时,只需要在 FileInputStream 对象上再套一层 BufferedInputStream 对象即可。

1 FileInputStream fileInputStream = new FileInputStream(filePath);
2 BufferedInputStream bufferedInputStream = new BufferedInputStream(fileInputStream);

DataInputStream 装饰者提供了对更多数据类型进行输入的操作,比如 int、double 等基本类型。

四、字符操作

编码与解码

编码就是把字符转换为字节,而解码是把字节重新组合成字符。

如果编码和解码过程使用不同的编码方式那么就出现了乱码。

  • GBK 编码中,中文字符占 2 个字节,英文字符占 1 个字节;
  • UTF-8 编码中,中文字符占 3 个字节,英文字符占 1 个字节;
  • UTF-16be 编码中,中文字符和英文字符都占 2 个字节。

UTF-16be 中的 be 指的是 Big Endian,也就是大端。相应地也有 UTF-16le,le 指的是 Little Endian,也就是小端。

Java 的内存编码使用双字节编码 UTF-16be,这不是指 Java 只支持这一种编码方式,而是说 char 这种类型使用 UTF-16be 进行编码。char 类型占 16 位,也就是两个字节,Java 使用这种双字节编码是为了让一个中文或者一个英文都能使用一个 char 来存储。

String 可以看成一个字符序列,可以指定一个编码方式将它编码为字节序列,也可以指定一个编码方式将一个字节序列解码为 String。

1 public static void main(String[] args) throws UnsupportedEncodingException {
2 String str1 = "深圳";
3 byte[] bytes = str1.getBytes("UTF-8");
4 System.out.println(bytes); // [B@4bec1f0c
5 String str2 = new String(bytes, "UTF-8");
6 System.out.println(str2); // 深圳
7 }

在调用无参数 getBytes() 方法时,默认的编码方式不是 UTF-16be。双字节编码的好处是可以使用一个 char 存储中文和英文,而将 String 转为 bytes[] 字节数组就不再需要这个好处,因此也就不再需要双字节编码。getBytes() 的默认编码方式与平台有关,一般为 UTF-8。

byte[] bytes = str1.getBytes();

Reader 与 Writer

不管是磁盘还是网络传输,最小的存储单元都是字节,而不是字符。但是在程序中操作的通常是字符形式的数据,因此需要提供对字符进行操作的方法。

  • InputStreamReader 实现从字节流解码成字符流;
  • OutputStreamWriter 实现字符流编码成为字节流。

实现逐行输出文本文件的内容

 1 public static void readFileContent(String filePath) throws IOException {
2
3 FileReader fileReader = new FileReader(filePath);
4 BufferedReader bufferedReader = new BufferedReader(fileReader);
5
6 String line;
7 while ((line = bufferedReader.readLine()) != null) {
8 System.out.println(line);
9 }
10
11 // 装饰者模式使得 BufferedReader 组合了一个 Reader 对象
12 // 在调用 BufferedReader 的 close() 方法时会去调用 Reader 的 close() 方法
13 // 因此只要一个 close() 调用即可
14 bufferedReader.close();
15 }

五、对象操作

序列化

序列化就是将一个对象转换成字节序列,方便存储和传输。

  • 序列化:ObjectOutputStream.writeObject()
  • 反序列化:ObjectInputStream.readObject()

不会对静态变量进行序列化,因为序列化只是保存对象的状态,静态变量属于类的状态。

Serializable

序列化的类需要实现 Serializable 接口,它只是一个标准,没有任何方法需要实现,但是如果不去实现它的话而进行序列化,会抛出异常。

 1 public class QrController {
2 public static void main(String[] args) throws IOException, ClassNotFoundException {
3
4 A a1 = new A(123, "abc");
5 String objectFile = "/TJT/Code/Test.class";
6
7 ObjectOutputStream objectOutputStream = new ObjectOutputStream(new FileOutputStream(objectFile));
8 objectOutputStream.writeObject(a1);
9 objectOutputStream.close();
10
11 ObjectInputStream objectInputStream = new ObjectInputStream(new FileInputStream(objectFile));
12 A a2 = (A) objectInputStream.readObject();
13 objectInputStream.close();
14 System.out.println(a2);
15 }
16
17 private static class A implements Serializable {
18
19 private int x;
20 private String y;
21
22 A(int x, String y) {
23 this.x = x;
24 this.y = y;
25 }
26
27 @Override
28 public String toString() {
29 return "x = " + x + " " + "y = " + y;
30 }
31 }
32 }

transient

transient 关键字可以使一些属性不会被序列化。

transient 关键字语法链接:https://www.cnblogs.com/taojietaoge/p/10260145.html

ArrayList 中存储数据的数组 elementData 是用 transient 修饰的,因为这个数组是动态扩展的,并不是所有的空间都被使用,因此就不需要所有的内容都被序列化。通过重写序列化和反序列化方法,使得可以只序列化数组中有内容的那部分数据。

private transient Object[] elementData;

六、网络操作

Java 中的网络支持:

  • InetAddress:用于表示网络上的硬件资源,即 IP 地址;
  • URL:统一资源定位符;
  • Sockets:使用 TCP 协议实现网络通信;
  • Datagram:使用 UDP 协议实现网络通信。

InetAddress

没有公有的构造函数,只能通过静态方法来创建实例。

1 InetAddress.getByName(String host);
2 // InetAddress ipAddress = InetAddress.getByName(ip);// 指定获取到的IP地址
3 InetAddress.getByAddress(byte[] address);

URL

可以直接从 URL 中读取字节流数据。

 1 import java.io.BufferedReader;
2 import java.io.IOException;
3 import java.io.InputStream;
4 import java.io.InputStreamReader;
5 import java.net.URL;
6
7
8 public class User {
9 public static void main(String[] args) throws IOException {
10
11 URL url = new URL("http://www.baidu.com");
12
13 /* 字节流 */
14 InputStream is = url.openStream();
15
16 /* 字符流 */
17 InputStreamReader isr = new InputStreamReader(is, "utf-8");
18
19 /* 提供缓存功能 */
20 BufferedReader br = new BufferedReader(isr);
21
22 String line;
23 while ((line = br.readLine()) != null) {
24 System.out.println(line);
25 }
26
27 br.close();
28 }
29
30 }

Sockets

  • ServerSocket:服务器端类
  • Socket:客户端类
  • 服务器和客户端通过 InputStream 和 OutputStream 进行输入输出。

Datagram

  • DatagramSocket:通信类
  • DatagramPacket:数据包类

七、NIO

新的输入/输出 (NIO) 库是在 JDK 1.4 中引入的,弥补了原来的 I/O 的不足,提供了高速的、面向块的 I/O;非阻塞IO,作为原始IO的补充,为了应对高性能高并发的应用场景。

流与块

I/O 与 NIO 最重要的区别是数据打包和传输的方式,I/O 以流的方式处理数据,而 NIO 以块的方式处理数据。

面向流的 I/O 一次处理一个字节数据:一个输入流产生一个字节数据,一个输出流消费一个字节数据。为流式数据创建过滤器非常容易,链接几个过滤器,以便每个过滤器只负责复杂处理机制的一部分。不利的一面是,面向流的 I/O 通常相当慢。

面向块的 I/O 一次处理一个数据块,按块处理数据比按流处理数据要快得多。但是面向块的 I/O 缺少一些面向流的 I/O 所具有的优雅性和简单性。

I/O 包和 NIO 已经很好地集成了,java.io.* 已经以 NIO 为基础重新实现了,所以现在它可以利用 NIO 的一些特性。例如,java.io.* 包中的一些类包含以块的形式读写数据的方法,这使得即使在面向流的系统中,处理速度也会更快。

通道与缓冲区

1. 通道

通道 Channel 是对原 I/O 包中的流的模拟,可以通过它读取和写入数据。

通道与流的不同之处在于,流只能在一个方向上移动(一个流必须是 InputStream 或者 OutputStream 的子类),而通道是双向的,可以用于读、写或者同时用于读写。

通道包括以下类型:

  • FileChannel:从文件中读写数据;
  • DatagramChannel:通过 UDP 读写网络中数据;
  • SocketChannel:通过 TCP 读写网络中数据;
  • ServerSocketChannel:可以监听新进来的 TCP 连接,对每一个新进来的连接都会创建一个 SocketChannel。

2. 缓冲区

发送给一个通道的所有数据都必须首先放到缓冲区中,同样地,从通道中读取的任何数据都要先读到缓冲区中。也就是说,不会直接对通道进行读写数据,而是要先经过缓冲区。

缓冲区实质上是一个数组,但它不仅仅是一个数组。缓冲区提供了对数据的结构化访问,而且还可以跟踪系统的读/写进程。

缓冲区包括以下类型:

  • ByteBuffer
  • CharBuffer
  • ShortBuffer
  • IntBuffer
  • LongBuffer
  • FloatBuffer
  • DoubleBuffer

文件 NIO 实例

以下展示了使用 NIO 快速复制文件的实例:

 1 public static void fastCopy(String src, String dist) throws IOException {
2
3 /* 获得源文件的输入字节流 */
4 FileInputStream fin = new FileInputStream(src);
5
6 /* 获取输入字节流的文件通道 */
7 FileChannel fcin = fin.getChannel();
8
9 /* 获取目标文件的输出字节流 */
10 FileOutputStream fout = new FileOutputStream(dist);
11
12 /* 获取输出字节流的文件通道 */
13 FileChannel fcout = fout.getChannel();
14
15 /* 为缓冲区分配 1024 个字节 */
16 ByteBuffer buffer = ByteBuffer.allocateDirect(1024);
17
18 while (true) {
19
20 /* 从输入通道中读取数据到缓冲区中 */
21 int r = fcin.read(buffer);
22
23 /* read() 返回 -1 表示 EOF */
24 if (r == -1) {
25 break;
26 }
27
28 /* 切换读写 */
29 buffer.flip();
30
31 /* 把缓冲区的内容写入输出文件中 */
32 fcout.write(buffer);
33
34 /* 清空缓冲区 */
35 buffer.clear();
36 }
37 }

选择器

NIO 常常被叫做非阻塞 IO,主要是因为 NIO 在网络通信中的非阻塞特性被广泛使用。

NIO 实现了 IO 多路复用中的 Reactor 模型,一个线程 Thread 使用一个选择器 Selector 通过轮询的方式去监听多个通道 Channel 上的事件,从而让一个线程就可以处理多个事件。

通过配置监听的通道 Channel 为非阻塞,那么当 Channel 上的 IO 事件还未到达时,就不会进入阻塞状态一直等待,而是继续轮询其它 Channel,找到 IO 事件已经到达的 Channel 执行。

因为创建和切换线程的开销很大,因此使用一个线程来处理多个事件而不是一个线程处理一个事件,对于 IO 密集型的应用具有很好地性能。

应该注意的是,只有套接字 Channel 才能配置为非阻塞,而 FileChannel 不能,为 FileChannel 配置非阻塞也没有意义。

1. 创建选择器

Selector selector = Selector.open();

2. 将通道注册到选择器上

1 ServerSocketChannel ssChannel = ServerSocketChannel.open();
2 ssChannel.configureBlocking(false); // 将通道设置为非阻塞
3 ssChannel.register(selector, SelectionKey.OP_ACCEPT);

通道必须配置为非阻塞模式,否则使用选择器就没有任何意义了,因为如果通道在某个事件上被阻塞,那么服务器就不能响应其它事件,必须等待这个事件处理完毕才能去处理其它事件,显然这和选择器的作用背道而驰。

在将通道注册到选择器上时,还需要指定要注册的具体事件,主要有以下几类:

  • SelectionKey.OP_CONNECT
  • SelectionKey.OP_ACCEPT
  • SelectionKey.OP_READ
  • SelectionKey.OP_WRITE

它们在 SelectionKey 的定义如下:

1 public static final int OP_READ = 1 << 0;
2 public static final int OP_WRITE = 1 << 2;
3 public static final int OP_CONNECT = 1 << 3;
4 public static final int OP_ACCEPT = 1 << 4;

可以看出每个事件可以被当成一个位域,从而组成事件集整数。例如:

int interestSet = SelectionKey.OP_READ | SelectionKey.OP_WRITE;

3. 监听事件

int num = selector.select();

使用 select() 来监听到达的事件,它会一直阻塞直到有至少一个事件到达。

4. 获取到达的事件

 1 Set<SelectionKey> keys = selector.selectedKeys();
2 Iterator<SelectionKey> keyIterator = keys.iterator();
3 while (keyIterator.hasNext()) {
4 SelectionKey key = keyIterator.next();
5 if (key.isAcceptable()) {
6 // do what you want to do
7 } else if (key.isReadable()) {
8 // do what u want to do
9 }
10 keyIterator.remove();
11 }

5. 事件循环

因为一次 select() 调用不能处理完所有的事件,并且服务器端有可能需要一直监听事件,因此服务器端处理事件的代码一般会放在一个死循环内。

 1 while (true) {
2 int num = selector.select();
3 Set<SelectionKey> keys = selector.selectedKeys();
4 Iterator<SelectionKey> keyIterator = keys.iterator();
5 while (keyIterator.hasNext()) {
6 SelectionKey key = keyIterator.next();
7 if (key.isAcceptable()) {
8 // ...
9 } else if (key.isReadable()) {
10 // ...
11 }
12 keyIterator.remove();
13 }
14 }

套接字 NIO 实例

 1 public class NIOServer {
2
3 public static void main(String[] args) throws IOException {
4
5 Selector selector = Selector.open();
6
7 ServerSocketChannel ssChannel = ServerSocketChannel.open();
8 ssChannel.configureBlocking(false);
9 ssChannel.register(selector, SelectionKey.OP_ACCEPT);
10
11 ServerSocket serverSocket = ssChannel.socket();
12 InetSocketAddress address = new InetSocketAddress("127.0.0.1", 8888);
13 serverSocket.bind(address);
14
15 while (true) {
16
17 selector.select();
18 Set<SelectionKey> keys = selector.selectedKeys();
19 Iterator<SelectionKey> keyIterator = keys.iterator();
20
21 while (keyIterator.hasNext()) {
22
23 SelectionKey key = keyIterator.next();
24
25 if (key.isAcceptable()) {
26
27 ServerSocketChannel ssChannel1 = (ServerSocketChannel) key.channel();
28
29 // 服务器会为每个新连接创建一个 SocketChannel
30 SocketChannel sChannel = ssChannel1.accept();
31 sChannel.configureBlocking(false);
32
33 // 这个新连接主要用于从客户端读取数据
34 sChannel.register(selector, SelectionKey.OP_READ);
35
36 } else if (key.isReadable()) {
37
38 SocketChannel sChannel = (SocketChannel) key.channel();
39 System.out.println(readDataFromSocketChannel(sChannel));
40 sChannel.close();
41 }
42
43 keyIterator.remove();
44 }
45 }
46 }
47
48 private static String readDataFromSocketChannel(SocketChannel sChannel) throws IOException {
49
50 ByteBuffer buffer = ByteBuffer.allocate(1024);
51 StringBuilder data = new StringBuilder();
52
53 while (true) {
54
55 buffer.clear();
56 int n = sChannel.read(buffer);
57 if (n == -1) {
58 break;
59 }
60 buffer.flip();
61 int limit = buffer.limit();
62 char[] dst = new char[limit];
63 for (int i = 0; i < limit; i++) {
64 dst[i] = (char) buffer.get(i);
65 }
66 data.append(dst);
67 buffer.clear();
68 }
69 return data.toString();
70 }
71 }
1 public class NIOClient {
2 public static void main(String[] args) throws IOException {
3 Socket socket = new Socket("127.0.0.1", 8888);
4 OutputStream out = socket.getOutputStream();
5 String s = "do what you want to do";
6 out.write(s.getBytes());
7 out.close();
8 }
9 }

内存映射文件

内存映射文件 I/O 是一种读和写文件数据的方法,它可以比常规的基于流或者基于通道的 I/O 快得多。

向内存映射文件写入可能是危险的,只是改变数组的单个元素这样的简单操作,就可能会直接修改磁盘上的文件。修改数据与将数据保存到磁盘是没有分开的。

下面代码行将文件的前 1024 个字节映射到内存中,map() 方法返回一个 MappedByteBuffer,它是 ByteBuffer 的子类。因此,可以像使用其他任何 ByteBuffer 一样使用新映射的缓冲区,操作系统会在需要时负责执行映射。

MappedByteBuffer mbb = fc.map(FileChannel.MapMode.READ_WRITE, 0, 1024);

对比

NIO 与普通 I/O 的区别主要有以下两点:

  • NIO 是非阻塞的;
  • NIO 面向块,I/O 面向流。
 

君如载酒须尽醉

醉来不复思天涯

备战-Java IO的更多相关文章

  1. 备战-Java 基础

    备战-Java 基础 仰天大笑出门去,我辈岂是蓬蒿人. 简介:备战-Java 基础. 一.基本数据类型 1.Java基本数据类型 基本数据类型有8种:byte.short.int.long.float ...

  2. 备战-Java 容器

    备战-Java 容器 玉阶生白露,夜久侵罗袜. 简介:备战-Java 容器 一.概述 容器主要包括 Collection 和 Map 两种,Collection 存储着对象的集合,而 Map 存储着k ...

  3. 备战- Java虚拟机

    备战- Java虚拟机 试问岭南应不好,却道,此心安处是吾乡. 简介:备战- Java虚拟机 一.运行时数据区域 程序计算器.Java 虚拟机栈.本地方法栈.堆.方法区 在Java 运行环境参考链接: ...

  4. java.IO输入输出流:过滤流:buffer流和data流

    java.io使用了适配器模式装饰模式等设计模式来解决字符流的套接和输入输出问题. 字节流只能一次处理一个字节,为了更方便的操作数据,便加入了套接流. 问题引入:缓冲流为什么比普通的文件字节流效率高? ...

  5. Java:IO流与文件基础

    Java:IO流与文件基础 说明: 本章内容将会持续更新,大家可以关注一下并给我提供建议,谢谢啦. 走进流 什么是流 流:从源到目的地的字节的有序序列. 在Java中,可以从其中读取一个字节序列的对象 ...

  6. Java IO之字符流和文件

    前面的博文介绍了字节流,那字符流又是什么流?从字面意思上看,字节流是面向字节的流,字符流是针对unicode编码的字符流,字符的单位一般比字节大,字节可以处理任何数据类型,通常在处理文本文件内容时,字 ...

  7. java Io流向指定文件输入内容

    package com.hp.io; import java.io.*; public class BufferedWriterTest{ public static void main(String ...

  8. java Io文件输入输出流 复制文件

    package com.hp.io; import java.io.FileInputStream; import java.io.FileNotFoundException; import java ...

  9. java Io流更新文件内容

    package com.hp.io; import java.io.FileOutputStream; import java.io.IOException; public class FileOut ...

随机推荐

  1. 使用Relay部署编译ONNX模型

    使用Relay部署编译ONNX模型 本文介绍如何使用Relay部署ONNX模型的入门. 首先,必须安装ONNX软件包. 一个快速的解决方案是安装protobuf编译器,然后 pip install o ...

  2. TVM虚拟机配置

    TVM虚拟机配置 目录 3.1. Supported Guest Operating Systems 3.1.1. Mac OS X Guests 3.1.2. 64-bit Guests 3.2. ...

  3. 与现代传感器的接口:轮询ADC驱动程序

    与现代传感器的接口:轮询ADC驱动程序 Interfacing with modern sensors: Polled ADC drivers 我们研究了在现代嵌入式应用程序中,开发人员应该如何创建一 ...

  4. C++标准模板库(STL)——set常见用法详解

    set的定义 set<typename> name; typename可以是任何基本类型,如int.double.char.结构体等,也可以是STL标准容器,如vector.set.que ...

  5. RabbitMQ由浅入深入门全总结(一)

    写在最前面 距离上一次发文章已经很久了,其实这段时间一直也没有停笔,只不过在忙着找工作还有学校结课的事情,重新弄了一下博客,后面也会陆陆续续会把文章最近更新出来~ 这篇文章有点长,就分了两篇Q PS: ...

  6. python学习笔记01-简单接触

    前言:陆陆续续学习python一年多了,每次都因为各种原因中断了,希望这次可以通过记录更新的方式坚持学完一轮. 简单了解python Python是一种解释型.面向对象.动态数据类型的高级程序设计语言 ...

  7. Hdoop

    优势:1.低成本  2.高扩展 3.成熟的生态圈 1.安装虚拟机 vi /etc/profile

  8. Linux关闭打开防火墙命令

    Linux下打开和关闭防火墙 1.及时生效,重启后复原 关闭:service iptables stop  开启:service iptalbes start  查看状态:service iptabl ...

  9. 65.QT-UDP组播实现多人共享桌面(同时支持收发显示)

    这里我们只是简单学习下通过udp组播如何共享桌面demo.帧率上面比较低,毕竟没有用推流,只是简单的将图片发送到组播地址,而加入组播地址的客户端去取数据显示而已. 主要是为了学习UDP知识而写的,真的 ...

  10. pipenv管理模块和包

    pipenv安装 1. 在终端输入:pip install pipenv进行安装 用pipenv创建虚拟环境:pipenv install,在哪个文件下运行这个命令,就是给哪个文件创建虚拟环境   这 ...