通知 | 清华大学《大数据实践课》宣讲会即将开启!
数据派THU
共 982字,需浏览 2分钟
·
2022-05-30 21:22
评论
PiFlow大数据流水线系统
PiFlow是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性:简单
PiFlow大数据流水线系统
0
PrestoDB大数据查询引擎
Presto是Facebook最新研发的数据查询引擎,可对250PB以上的数据进行快速地交互式分析。据称该引擎的性能是Hive的10倍以上。PrestoDB是Facebook推出的一个大数据的分布式S
PrestoDB大数据查询引擎
0