PiFlow v0.5 发布:大数据流水线系统

百度智能云 云生态狂欢季 热门云产品1折起>>>   PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性: 简单易用:可视化配置流水线,实时监控流水线运行状态,查看日志 功能强大:提供100+的数据处理组件, 包括Hadoop 、Spark、MLlib、H
相关文章
相关标签/搜索