Spark Streaming总结-----学习笔记

支持多种数据源:Kafka、Flume、HDFS、普通TCP套接字等; 基本原理:实时输入数据流以时间片(秒级)为单位进行拆分,然后经Spark引擎以类似批处理的方式处理每个时间片数据; Spark Streaming最主要的抽象是DStream(Discretized Stream,离散化数据流),表示连续不断的数据流。在内部实现上,Spark Streaming的输入数据按照时间片(如1秒)分
相关文章
相关标签/搜索