笔记presto、Druid、kylin和flink的应用场景

应用场景

  • presto

Presto是Facebook开发的数据查询引擎。对orc文件读取做了优化,建议建表使用orc,压缩使用snappy。大表放左边。基于内存,不使用mapreduce,能够连接多个数据源,跨数据源表查询

适合场景:
适合如count,avg聚合运算,边计算边清内存,支持GB到PB,主要用来处理秒级场景。

缺点:
不适合联表查询

  • Druid

是一个实时分析型的数据库,支持实时分析,列式分布式的存储系统,处理PB毫秒级查询。

适合场景:
用于清洗好的,不需要更新的单表,实时性高,数据质量敏感不高的场景

  • kylin

kylin是一个开源的、分布式的分析型数据仓库。使用预计算技术,预先对数据做多维索引,查询只扫描索引不访问原始数据,目前只支持星型模型。

适合场景:
主要配合hive,多维分析

  • flink

Flink是一个分布式处理引擎。批处理主要处理大容量的静态数据集;流处理基于事件的,处理数据无边界,处理结果立即可用,持续更新。

适合场景:
流批一体,实时采集、实时计算

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
impala是一种高性能分析型数据库,它基于Hadoop生态系统,可以快速执行复杂的查询。它使用列式存储、编译器技术和并行查询执行来实现高性能。 druid是一个快速、实时的数据存储和分析引擎,它适用于大规模的实时数据处理和探索式分析。它支持实时数据摄取、查询和可视化,可用于数据仪表盘和实时报告等应用。 presto是一种开源的分布式SQL查询引擎,它可以快速查询多种数据源,包括Hadoop、MySQL等。它具有高度可伸缩性和灵活性,可用于快速进行复杂的数据分析和联机查询。 kylin是一种开源的分布式分析引擎,它可以快速处理大规模数据集。它支持多维分析和复杂的OLAP查询,并提供了数据立方体和预计算功能,用于加速查询速度。 clickhouse是一种列式数据库管理系统,专门用于高性能分析型应用。它支持实时查询和高并发访问,并具有低延迟和高容量的优势,适用于大规模的数据分析和数据仪表盘等应用。 greenplum是一种高性能的并行关系数据库管理系统,适用于大规模数据仓库和分析型应用。它具有高度可伸缩性、并行查询和优化的特性,用于高速查询和处理大规模数据。 总的来说,这些数据库和查询引擎都旨在提供高性能和灵活性,以满足大规模数据分析和查询的需求,但它们在技术架构、数据存储方式和查询优化等方面存在一些差异。选择适合特定需求的数据库和查询引擎取决于实际情况和使用场景。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值