葵花宝典--Azkaban

一 概述 1.1 为什么需要工作流调度系统 1)一个完整的数据分析系统通常都是由大量任务单元组成: shell 脚本程序,java 程序,mapreduce 程序、hive 脚本等。 2)各任务单元之间存在时间先后及前后依赖关系。 3)为了很好地组织起这样的复杂执行计划,需要一个工作流调度系统来调度执行。    例如,我们可能有这样一个需求,某个业务系统每天产生 20G 原始数据,我们每天都要对其
相关文章
相关标签/搜索