一篇文章搞懂数据仓库:数据仓库架构-Lambda和Kappa对比

Kappa

=================================================================

Kappa架构原理


Kappa架构的核心思想包括以下三点:

  • 用Kafka或者类似的分布式队列系统保存数据,你需要几天的数据量就保存几天。

  • 当需要全量重新计算时,重新起一个流计算实例,从头开始读取数据进行处理,并输出到一个新的结果存储中。

  • 当新的实例做完后,停止老的流计算实例,并把老的一些结果删除。

在这里插入图片描述在Kappa架构下,只有在有必要的时候才会对历史数据进行重复计算,并且实时计算和批处理过程使用的是同

  • 25
    点赞
  • 20
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
学习收获: 1. 实时数据仓库架构设计:实时数据仓库架构设计是为了满足实时数据处理和分析需求而提出的一种架构设计。它能够将实时数据和历史数据进行有效整合,提供实时的数据查询和分析能力。 2. Lambda架构Lambda架构是一种用于构建实时大数据处理系统的架构模式。它将数据处理分为两个流程:批处理和实时处理。批处理用于离线处理大量的历史数据,而实时处理则用于处理实时产生的数据。通过将批处理和实时处理结果进行合并,Lambda架构能够提供全面且及时的数据分析。 3. Kappa架构Kappa架构是一种简化版的Lambda架构,它将批处理和实时处理合并为一个统一的流处理过程。Kappa架构使用流处理系统来处理所有的数据,无论是历史数据还是实时数据。这样可以简化系统架构,并提供更低的延迟和更高的吞吐量。 4. 流批结合的实时数仓:流批结合的实时数仓是一种将流处理和批处理相结合的架构设计。它利用流处理系统对实时数据进行处理和分析,同时通过批处理系统对历史数据进行处理和分析。这种结合能够满足实时和历史数据的需求,并提供更全面和准确的数据分析结果。 通过学习实时数据仓库架构设计、Lambda架构Kappa架构以及流批结合的实时数仓,我了解到了如何构建和优化实时大数据处理系统,以及如何满足实时数据分析的需求。这些知识对于处理大规模实时数据和提供实时数据分析能力非常有帮助。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值