原文连接:『 Spark 』1. spark 简介git
本系列是综合了本身在学习spark过程当中的理解记录 + 对参考文章中的一些理解 + 我的实践spark过程当中的一些心得而来。写这样一个系列仅仅是为了梳理我的学习spark的笔记记录,并不是为了作什么教程,因此一切以我的理解梳理为主,没有必要的细节就不会记录了。若想深刻了解,最好阅读参考文章和官方文档。github
其次,本系列是基于目前最新的 spark 1.6.0 系列开始的,spark 目前的更新速度很快,记录一下版本好仍是必要的。
最后,若是各位以为内容有误,欢迎留言备注,全部留言 24 小时内一定回复,很是感谢。
Tips: 若是插图看起来不明显,能够:1. 放大网页;2. 新标签中打开图片,查看原图哦。sql
Apache Spark™ is a fast and general engine for large-scale data processing.编程
Apache Spark is a fast and general-purpose cluster computing system.
It provides high-level APIs in Java, Scala, Python and R
, and an optimized engine that supports general execution graphs.
It also supports a rich set of higher-level tools including :app
Spark started in 2009, open sourced 2010, unlike the various specialized systems[hadoop, storm], Spark’s goal was to :ide
generalize MapReduce to support new apps within same engineoop
speed up iteration computing over hadoop.学习
下一篇,简单介绍 spark 里必须深入理解的基本概念。大数据