360深度实践：Flink 与 Storm 协议级对比

时间 2019-12-09

标签深度实践 flink storm 协议对比栏目 Storm 繁體版

原文原文链接

做者：张馨予算法

本文从数据传输和数据可靠性的角度出发，对比测试了 Storm 与 Flink 在流处理上的性能，并对测试结果进行分析，给出在使用 Flink 时提升性能的建议。安全

Apache Storm、Apache Spark 和 Apache Flink 都是开源社区中很是活跃的分布式计算平台，在不少公司可能同时使用着其中两种甚至三种。对于实时计算来讲，Storm 与 Flink 的底层计算引擎是基于流的，本质上是一条一条的数据进行处理，且处理的模式是流水线模式，即全部的处理进程同时存在，数据在这些进程之间流动处理。而 Spark 是基于批量数据的处理，即一小批一小批的数据进行处理，且处理的逻辑在一批数据准备好以后才会进行计算。在本文中，咱们把一样基于流处理的 Storm 和 Flink 拿来作对比测试分析。网络

在咱们作测试以前，调研了一些已有的大数据平台性能测试报告，好比，雅虎的 Streaming-benchmarks，或者 Intel 的 HiBench 等等。除此以外，还有不少的论文也从不一样的角度对分布式计算平台进行了测试。虽然这些测试 case 各有不一样的侧重点，但他们都用到了一样的两个指标，即吞吐和延迟。吞吐表示单位时间内所能处理的数据量，是能够经过增大并发来提升的。延迟表明处理一条数据所须要的时间，与吞吐量成反比关系。并发

在咱们设计计算逻辑时，首先考虑一下流处理的计算模型。上图是一个简单的流计算模型，在 Source 中将数据取出，发往下游 Task ，并在 Task 中进行处理，最后输出。对于这样的一个计算模型，延迟时间由三部分组成：数据传输时间、 Task 计算时间和数据排队时间。咱们假设资源足够，数据不用排队。则延迟时间就只由数据传输时间和 Task 计算时间组成。而在 Task 中处理所须要的时间与用户的逻辑息息相关，因此对于一个计算平台来讲，数据传输的时间才更能反映这个计算平台的能力。所以，咱们在设计测试 Case 时，为了更好的体现出数据传输的能力，Task 中没有设计任何计算逻辑。分布式

在肯定数据源时，咱们主要考虑是在进程中直接生成数据，这种方法在不少以前的测试标准中也一样有使用。这样作是由于数据的产生不会受到外界数据源系统的性能限制。但因为在咱们公司内部大部分的实时计算数据都来源于 kafka ，因此咱们增长了从 kafka 中读取数据的测试。性能

对于数据传输方式，能够分为两种：进程间的数据传输和进程内的数据传输。测试

进程间的数据传输是指这条数据会通过序列化、网络传输和反序列化三个步骤。在 Flink 中，2个处理逻辑分布在不一样的 TaskManager 上，这两个处理逻辑之间的数据传输就能够叫作进程间的数据传输。Flink 网络传输是采用的 Netty 技术。在 Storm 中，进程间的数据传输是 worker 之间的数据传输。早版本的 storm 网络传输使用的 ZeroMQ，如今也改为了 Netty。大数据

进程内的数据传输是指两个处理逻辑在同一个进程中。在 Flink 中，这两个处理逻辑被 Chain 在了一块儿，在一个线程中经过方法调用传参的形式进程数据传输。在 Storm 中，两个处理逻辑变成了两个线程，经过一个共享的队列进行数据传输。优化

Storm 和 Flink 都有各自的可靠性机制。在 Storm 中，使用 ACK 机制来保证数据的可靠性。而在 Flink 中是经过 checkpoint 机制来保证的，这是来源于 chandy-lamport 算法。spa

事实上 Exactly-once 可靠性的保证跟处理的逻辑和结果输出的设计有关。好比结果要输出到kafka中，而输出到kafka的数据没法回滚，这就没法保证 Exactly-once。咱们在测试的时候选用的 at-least-once 语义的可靠性和不保证可靠性两种策略进行测试。

上图是咱们测试的环境和各个平台的版本。

上图展现的是 Flink 在自产数据的状况下，不一样的传输方式和可靠性的吞吐量：在进程内+不可靠、进程内+可靠、进程间+不可靠、进程间+可靠。能够看到进程内的数据传输是进程间的数据传输的3.8倍。是否开启 checkpoint 机制对 Flink 的吞吐影响并不大。所以咱们在使用 Flink 时，进来使用进程内的传输，也就是尽量的让算子能够 Chain 起来。

那么咱们来看一下为何 Chain 起来的性能好这么多，要如何在写 Flink 代码的过程当中让 Flink 的算子 Chain 起来使用进程间的数据传输。

你们知道咱们在 Flink 代码时必定会建立一个 env，调用 env 的 disableOperatorChainning() 方法会使得全部的算子都没法 chain 起来。咱们通常是在 debug 的时候回调用这个方法，方便调试问题。

若是容许 Chain 的状况下，上图中 Source 和 mapFunction 就会 Chain 起来，放在一个 Task 中计算。反之，若是不容许 Chain，则会放到两个 Task 中。

对于没有 Chain 起来的两个算子，他们被放到了不一样的两个 Task 中，那么他们之间的数据传输是这样的：SourceFunction 取到数据序列化后放入内存，而后经过网络传输给 MapFunction 所在的进程，该进程将数据方序列化后使用。

对于 Chain 起来的两个算子，他们被放到同一个Task中，那么这两个算子之间的数据传输则是：SourceFunction 取到数据后，进行一次深拷贝，而后 MapFunction 把深拷贝出来的这个对象做为输入数据。

虽然 Flink 在序列化上作了不少优化，跟不用序列化和不用网络传输的进程内数据传输对比，性能仍是差不少。因此咱们尽量的把算子 Chain 起来。

不是任何两个算子均可以 Chain 起来的，要把算子 Chain 起来有不少条件：第一，下游算子只能接受一种上游数据流，好比Map接受的流不能是一条 union 后的流；其次上下游的并发数必定要同样；第二，算子要使用同一个资源 Group，默认是一致的，都是 default；第三，就是以前说的 env 中不能调用 disableOperatorChainning() 方法，最后，上游发送数据的方法是 Forward 的，好比，开发时没有调用 rebalance() 方法，没有 keyby()，没有 boardcast 等。

对比一下自产数据时，使用进程内通讯，且不保证数据可靠性的状况下，Flink 与 Storm 的吞吐。在这种状况下，Flink 的性能是 Storm 的15倍。Flink 吞吐能达到2060万条/s。不只如此，若是在开发时调用了env.getConfig().enableObjectReuse() 方法，Flink 的但并发吞吐能达到4090万条/s。

当调用了 enableObjectReuse 方法后，Flink 会把中间深拷贝的步骤都省略掉，SourceFunction 产生的数据直接做为 MapFunction 的输入。但须要特别注意的是，这个方法不能随便调用，必需要确保下游 Function 只有一种，或者下游的 Function 均不会改变对象内部的值。不然可能会有线程安全的问题。

当对比在不一样可靠性策略的状况下，Flink 与 Storm 的表现时，咱们发现，保证可靠性对 Flink 的影响很是小，但对 Storm 的影响很是大。总的来讲，在保证可靠的状况下，Flink 单并发的吞吐是 Storm 的15倍，而不保证可靠的状况下，Flink 的性能是 Storm 的66倍。会产生这样的结果，主要是由于 Flink 与 Storm 保证数据可靠性的机制不一样。

而 Storm 的 ACK 机制为了保证数据的可靠性，开销更大。

左边的图展现的是 Storm 的 ACK 机制。Spout 每发送一条数据到 Bolt，就会产生一条 ACK 的信息给 ACKer ，当 Bolt 处理完这条数据后也会发送 ACK 信息给 ACKer。当 ACKer 收到这条数据的全部 ACK 信息时，会回复 Spout 一条 ACK 信息。也就是说，对于一个只有两级（spout+bolt）的拓扑来讲，每发送一条数据，就会传输3条 ACK 信息。这3条 ACK 信息则是为了保证可靠性所须要的开销。

右边的图展现的是 Flink 的 Checkpoint 机制。Flink 中 Checkpoint 信息的发起者是 JobManager。它不像 Storm 中那样，每条信息都会有 ACK 信息的开销，并且按时间来计算花销。用户能够设置作 checkpoint 的频率，好比10秒钟作一次 checkpoint。每作一次 checkpoint，花销只有从 Source 发往 map 的1条 checkpoint 信息（JobManager 发出来的 checkpoint 信息走的是控制流，与数据流无关）。与 Storm 相比，Flink 的可靠性机制开销要低得多。这也就是为何保证可靠性对 Flink 的性能影响较小，而 Storm 的影响确很大的缘由。

最后一组自产数据的测试结果对比是 Flink 与 Storm 在进程间的数据传输的对比，能够看到进程间数据传输的状况下，Flink 但并发吞吐是 Storm 的4.7倍。保证可靠性的状况下，是 Storm 的14倍。

上图展现的是消费 kafka 中数据时，Storm 与 Flink 的但并发吞吐状况。由于消费的是 kafka 中的数据，因此吞吐量确定会收到 kafka 的影响。咱们发现性能的瓶颈是在 SourceFunction 上，因而增长了 topic 的 partition 数和 SourceFunction 取数据线程的并发数，可是 MapFunction 的并发数仍然是1.在这种状况下，咱们发现 Flink 的瓶颈转移到上游往下游发数据的地方。而 Storm 的瓶颈确是在下游收数据反序列化的地方。

以前的性能分析使咱们基于数据传输和数据可靠性的角度出发，单纯的对 Flink 与 Storm 计算平台自己进行了性能分析。但实际使用时，task 是确定有计算逻辑的，这就势必更多的涉及到 CPU，内存等资源问题。咱们未来打算作一个智能分析平台，对用户的做业进行性能分析。经过收集到的指标信息，分析出做业的瓶颈在哪，并给出优化建议。