DataLake with Hadoop Ecosystem

时间 2021-01-08

标签 DataLake Hadoop 栏目 Hadoop 繁體版

原文原文链接

Hadoop是实现数据湖最常用的技术手段，目前是最理想的选择，Hadoop生态系统提供批处理、实时处理引擎，还提供海量数据存储能力，数据处理架构如下图：目前常见的两种使用方式： 1）第一种方式是将Hadoop作为ETL工具，并且数据备份或者冷数据存储其PB级别数据，在Hadoop中数据冗余而且较容易恢复，如下图所示： MapReduce及Spark Engine可以用来处理非结构化数据，

>>阅读原文<<

相关文章

相关标签/搜索

每日一句

每一个你不满意的现在，都有一个你没有努力的曾经。

最新文章

本站公众号

欢迎关注本站公众号,获取更多信息

相关文章

1. Hadoop ecosystem
2. Hadoop ecosystem 生态圈
3. Data ETL tools for hadoop ecosystem Morphlines
4. Create a "collaborative ecosystem" with blockchain
5. DataLake in Azure
6. DataLake in Hortonworks
7. Big Data Ecosystem Dataset
8. DataLake in AWS
9. DataLake 基本概念
10. Kafka Ecosystem（Kafka生态）

>>更多相关文章<<