Spark中repartition和coalesce的用法

repartition(numPartitions:Int):RDD[T]和coalesce(numPartitions:Int,shuffle:Boolean=false):RDD[T]函数 他们两个都是RDD的分区进行从新划分,repartition只是coalesce接口中shuffle为true的简易实现,(假设RDD有N个分区,须要从新划分红M个分区)性能 1)、N<M。通常状况下N个分
相关文章
相关标签/搜索