深刻理解 Java中的 流 (Stream)


最近在看《Hadoop:The Definitive Guide》,对其分布式文件系统HDFS的Streaming data access不能理解。基于流的数据读写,太抽象了,什么叫基于流,什么是流?Hadoop是Java语言写的,因此想理解好Hadoop的Streaming Data Access,还得从Java流机制入手。流机制也是JAVA及C++中的一个重要的机制,经过流使咱们可以自由地操做包括文件,内存,IO设备等等中的数据。 java

首先,流是什么?

流是个抽象的概念,是对输入输出设备的抽象,Java程序中,对于数据的输入/输出操做都是以“流”的方式进行。设备能够是文件,网络,内存等。 网络

流具备方向性,至因而输入流仍是输出流则是一个相对的概念,通常以程序为参考,若是数据的流向是程序至设备,咱们成为输出流,反之咱们称为输入流。 分布式

能够将流想象成一个“水流管道”,水流就在这管道中造成了,天然就出现了方向的概念。 ide

当程序须要从某个数据源读入数据的时候,就会开启一个输入流,数据源能够是文件、内存或网络等等。相反地,须要写出数据到某个数据源目的地的时候,也会开启一个输出流,这个数据源目的地也能够是文件、内存或网络等等。 oop

流有哪些分类?

能够从不一样的角度对流进行分类: ui

1. 处理的数据单位不一样,可分为:字符流,字节流 spa

2.数据流方向不一样,可分为:输入流,输出流 .net

3.功能不一样,可分为:节点流,处理流 code

1. 和 2. 都比较好理解,对于根据功能分类的,能够这么理解: 对象

节点流:节点流从一个特定的数据源读写数据。即节点流是直接操做文件,网络等的流,例如FileInputStream和FileOutputStream,他们直接从文件中读取或往文件中写入字节流。

处理流:“链接”在已存在的流(节点流或处理流)之上经过对数据的处理为程序提供更为强大的读写功能。过滤流是使用一个已经存在的输入流或输出流链接建立的,过滤流就是对节点流进行一系列的包装。例如BufferedInputStream和BufferedOutputStream,使用已经存在的节点流来构造,提供带缓冲的读写,提升了读写的效率,以及DataInputStream和DataOutputStream,使用已经存在的节点流来构造,提供了读写Java中的基本数据类型的功能。他们都属于过滤流。

举个简单的例子:

复制代码
public static void main(String[] args) throws IOException {
        // 节点流FileOutputStream直接以A.txt做为数据源操做
        FileOutputStream fileOutputStream = new FileOutputStream("A.txt");
        // 过滤流BufferedOutputStream进一步装饰节点流,提供缓冲写
        BufferedOutputStream bufferedOutputStream = new BufferedOutputStream(
                fileOutputStream);
        // 过滤流DataOutputStream进一步装饰过滤流,使其提供基本数据类型的写
        DataOutputStream out = new DataOutputStream(bufferedOutputStream);
        out.writeInt(3);
        out.writeBoolean(true);
        out.flush();
        out.close();
        // 此处输入节点流,过滤流正好跟上边输出对应,读者可触类旁通
        DataInputStream in = new DataInputStream(new BufferedInputStream(
                new FileInputStream("A.txt")));
        System.out.println(in.readInt());
        System.out.println(in.readBoolean());
        in.close();
}
复制代码

流结构介绍

Java全部的流类位于java.io包中,都分别继承字如下四种抽象流类型。

  字节流 字符流
输入流 InputStream Reader
输出流 OutputStream Writer

1.继承自InputStream/OutputStream的流都是用于向程序中输入/输出数据,且数据的单位都是字节(byte=8bit),如图,深色的为节点流,浅色的为处理流。

 

2.继承自Reader/Writer的流都是用于向程序中输入/输出数据,且数据的单位都是字符(2byte=16bit),如图,深色的为节点流,浅色的为处理流。

常见流类介绍:

节点流类型常见的有:

对文件操做的字符流有FileReader/FileWriter,字节流有FileInputStream/FileOutputStream。

处理流类型常见的有:

缓冲流:缓冲流要“套接”在相应的节点流之上,对读写的数据提供了缓冲的功能,提升了读写效率,同事增长了一些新的方法。

  字节缓冲流有BufferedInputStream/BufferedOutputStream,字符缓冲流有BufferedReader/BufferedWriter,字符缓冲流分别提供了读取和写入一行的方法ReadLine和NewLine方法。

  对于输出地缓冲流,写出的数据,会先写入到内存中,再使用flush方法将内存中的数据刷到硬盘。因此,在使用字符缓冲流的时候,必定要先flush,而后再close,避免数据丢失。

转换流:用于字节数据到字符数据之间的转换。

  仅有字符流InputStreamReader/OutputStreamWriter。其中,InputStreamReader须要与InputStream“套接”,OutputStreamWriter须要与OutputStream“套接”。

数据流:提供了读写Java中的基本数据类型的功能。

  DataInputStream和DataOutputStream分别继承自InputStream和OutputStream,须要“套接”在InputStream和OutputStream类型的节点流之上。

对象流:用于直接将对象写入写出。

  流类有ObjectInputStream和ObjectOutputStream,自己这两个方法没什么,可是其要写出的对象有要求,该对象必须实现Serializable接口,来声明其是能够序列化的。不然,不能用对象流读写。

  还有一个关键字比较重要,transient,因为修饰实现了Serializable接口的类内的属性,被该修饰符修饰的属性,在以对象流的方式输出的时候,该字段会被忽略。

相关文章
相关标签/搜索