教程
问答
博客
Python源码
Java源码
开源
论坛
教程
问答
博客
Python源码
Java源码
开源
论坛
登录
注册
开源软件
大数据
数据处理
PiFlow
PiFlow
- 大数据流水线系统
数据处理
大数据
授权协议:
BSD
操作系统:
跨平台
开发语言:
Java
软件简介
PiFlow
是一个基于分布式计算框架Spark开发的大数据流水线系统。该系统将数据的采集、清洗、计算、存储等各个环节封装成组件,以所见即所得方式进行流水线配置。简单易用,功能强大。它具有如下特性:
简单易用:可视化配置流水线,实时监控流水线运行状态,查看日志
功能强大:提供100+的数据处理组件, 包括Hadoop 、Spark、MLlib、Hive、Solr、Redis、MemCache、ElasticSearch、JDBC、MongoDB、HTTP、FTP、XML、CSV、JSON等,同时集成了微生物领域的相关算法。
扩展性强:支持自定义开发数据处理组件
性能优越:基于分布式计算引擎Spark开发
软件首页