Hadoop — HDFS的概念、原理及基本操做

1. HDFS的基本概念和特性 设计思想——分而治之:将大文件、大批量文件分布式存放在大量服务器上,以便于采起分而治之的方式对海量数据进行运算分析。在大数据系统中做用:为各种分布式运算框架(如:mapreduce,spark,tez,....)提供数据存储服务。node 1.1 HDFS的概念 首先,它是一个文件系统,用于存储文件,经过统一的命名空间--目录树来定位文件;python 其次,它是分
相关文章
相关标签/搜索