Hadoop学习(十七)——azkaban原理及案例

1.1 概述 1.1.1为什么需要工作流调度系统 l 一个完整的数据分析系统通常都是由大量任务单元组成:shell脚本程序、java程序、mapreduce程序、hive脚本等。 l 各任务单元之间存在时间先后及前后依赖关系 l 为了很好地组织起这样的复杂执行计划,需要一个工作流调度系统来调度执行; 例如,我们可能有这样一个需求,某个业务系统每天产生20G原始数据,我们每天都要对其进行处理,处理步
相关文章
相关标签/搜索