【数据可视化】基础知识贴③:错综复杂散点图

散点图

热门图表工具下载:

散点图,若是学过咱们前面创意图表系列的话,这种图表应该很是熟悉了。大数据

散点图,在图表界有万表之王的称号。spa

这可不是我随便封的。设计

美国权威心理学专刊《Journal of the History of the Behavioral Sciences》(行为科学史杂志)在2005年一篇论文中如此评价散点图:htm

“Most versatile, polymorphic, and generally useful invention in the history of statistical graphics.”这是信息图表史上功能最多,形式多样,应用范围极为广阔的一个伟大发明!ci

散点图能获此评价,绝对不是吹出来的。get

正如它的名字同样,散点图,能够一堆纷乱如麻,看似无迹可寻的数据显示出内在的关系逻辑来。产品

散点图已经不只仅是一个图表了,它已经演化为一个强大的分析工具,能够这么说,散点图,就是为大数据而生的!it

下面,仍是让咱们一块儿回顾一下散点图的前世此生吧。

认识散点图

散点图,是绘制在X轴和Y轴坐标系中,能够同时表述两个变量的一组数据点。这些大量的数据点组合在一块儿,造成了一些形状,揭示了数据背后的相关信息。
散点图

在这个散点图中,就揭示了不一样系列的产品中,销售量与产品收入之间的关系模式。

散点图溯源

提及散点图的来由,若是你读过咱们启视录系列前面几篇的话,必定会想到一个名字:William Playfair。这是信息图史上一个神通常的存在,他将折线图、饼图还有条状图带到了咱们这个世界上。

但是,这一次你猜错了。

散点图不是普莱费尔发明的。

事实上,散点图的出现如同它的名字同样,散乱不堪,没法理出一个有序的线索出来。

其实,对于散点数据的的视觉化应用,由来已久。好几百年以来,人们一直将这些点放置在地图,或者笛卡尔坐标系中。后来人们逐渐意识到,当这些数据以不一样参数,放置在直角坐标系中,不少鲜为人知的故事会偷偷地浮现出来。因而,散点图逐渐开始流传开来。

因此只能这么说,散点图,是广大数据民工在长期的生产实践中,经过不断的探索和研究,最终发明出来的。

而William Playfair爵士之因此会与这个伟大的发明擦肩而过,主要是由于,他发明的图表都是基于时间序列的,而散点图却再也不拘泥于时间这个基本的变量。

散点图从一开始的默默无闻,到最后轰动科学界,直到最后加冕图表之王,其实也就是百十年的事。可是经过散点图带来的不少伟大的发现,则完全改变了咱们的世界观,推进了科学的发展。

1905年,丹麦科学家Danish astronomer Ejnar Hertzprung,在将一些恒星的亮度等级(绝对亮度}和他们的颜色(按光谱从蓝白到红色排列)进行对比的时候,他注意到这其中彷佛有着某些相关性。可是他一直没有找到其中的奥秘。

直到1913年,美国天文学家Henry Norris Russell独立发表论文,阐述了这个改变咱们认知宇宙的新发现。
散点图

没错,正是经过散点图,他将恒星的按光谱和亮度两个参数进行排列分析后发现,从高亮度低光谱(左上)到低亮度高光谱(右下)造成了一条明显的趋势线,而在左上角,还有一团比较密集的数据。

Henry意识到,这条趋势线,或许正揭示了恒星从蓝白色的新星到红色的老星的一个演变的过程,也就是说,他发现了恒星一辈子的秘密。而左上角的那些数据,则是由一些暮年的红巨星所集合而成。

这就是后来咱们所熟知的恒星的一辈子:原恒星—-主序星—-红巨星—-白矮星—-黑矮星

这是从新绘制的由2200颗恒星数据所组成的Henry Norris Russell散点图,咱们的太阳目前大体位于光序1(竖轴)色谱1.0左右的位置上,主序星阶段,正值壮年!

关于更多的散点图带来的伟大发现,你们能够到这里围观:http://www.datavis.ca/papers/friendly-scat.pdf我就再也不多说了。

散点图的应用

显而易见,散点图是一种应用很是普遍的图表,并且具备其余图表所没有的独特优点。

不像其余图表的单一特性,散点图不光能够显示趋势,还能显示集群的形状,以及在数据云团中各数据点的关系——这在大数据应用中是极为重要的一点。

不管是探寻肺活量与自由潜水的深度的关系,仍是研究地震强度与持续时间之间的关联,或者对比不一样部门利润与支出的数据,咱们均可以用散点图来进行不一样方位解读。

下面就是散点图所常常表现出来的几种趋势:
正相关
散点图
负相关
散点图
无关
散点图
线性相关
散点图
指数相关
散点图
离群值
散点图

这里要注意的是,并非全部的相关关系都是简单的因果关系,要注意其余变量的存在以及对数据的影响。

散点图的基本原则

对于散点图,咱们如今已经有了大体的一些了解,如今让咱们来看看散点图设计中的一些基本原则吧

Y轴从0开始
散点图

这个应该是咱们反复强调的了,Y轴从非零开始的话会截断数据,形成误读。

包含多重变量
散点图

经过改变数据点的大小和颜色,来表示数据值的区别。

添加趋势线
散点图

趋势线能够用来显示数据变化的趋势。

不要添加两条以上的趋势线
散点图

太多趋势线,反而搅乱视线。

来源:InfoVision

了解更多数据可视化相关资讯

相关文章
相关标签/搜索