Spark简介

一 简介与功能 Spark是基于内存计算的大数据分布式计算框架。Spark基于内存计算,提高了在大数据环境下数据处理的实时性,同时保证了高容错性和高可伸缩性,允许用户同时将Spark部署在大量廉价硬件之上,形成集群。 1 分布式计算 2 内存计算 3 容错 4 多计算范式 Spark于2009年诞生于加州大学伯克利分校AMPLab。目前,已经成为Apache软件基金会旗下顶级开源项目。 官网:ht
相关文章
相关标签/搜索