CAP和BASE理论

1. CAP定理

CAP理论告诉我们,一个分布式系统不可能同时满足一致性(C:Consistency),可用性(A:Availability)和分区容错性(P:Partition tolerance)这三个需求,最多只能同时满足其中的两项。
CAP定理示意图

1.1 一致性

  • 在分布式环境中,一致性是指数据在多个副本之间是否能够保持一致的特性。在一致性的需求下,当一个系统在数据一致的状况下执行更新操作后,应该保持系统的数据仍然处于一致性的状态。
  • 在分布式系统中,如果能够做到针对一个数据项的更新操作执行成功后,所有的用户都可以读取到其最新的值,那么这样的系统就被认为具有强一致性(或严格的一致性).

1.2 可用性

  • 可用性是指系统提供的服务必须一直处于可用的状态,对于用户的每一个操作请求总是能够在有限的时间内返回结果。
  • 有效的时间是指,对于一个用户的操作请求,系统必须能够在指定的时间(即响应时间)内返回对应的处理结果,如果超过了这个时间范围,那么系统就认为是不可用的。
  • 返回结果是可用性的另一个非常重要的指标,它要求系统在完成对用户请求的处理后,返回一个正常的响应结果。

1.3 分区容错性

  • 分区容错性约束了一个分布式系统需要具有以下特性:分布式系统在遇到任何网络分区故障的时候,仍然需要能够保证对外提供满足一致性和可用性的服务,除非是整个网络环境都出现了故障。

1.4 CAP定理应用

放弃CAP定理说明
放弃P一种较简单的做法是将所有的数据都放在一个分布式节点上。
放弃P的同事也就意味着放弃了系统的可扩展性
放弃A一旦系统遇到网络分区或其他故障时,那么收到影响的服务
需要等待一定的时间,因此在等待期间系统无法提供正常的
服务,即不可用
放弃C放弃一致性指的是放弃数据的强一致性,而保留数据的最终
一致性。这样的系统无法保证数据保持实时的一致性,但是
能够承诺的是,数据最终会达到一个一致的状态。这就引入
了一个时间窗口的概念,具体多长时间能够达到数据一致取
决于系统的设计,主要包括数据副本在不同节点之间的复制
时间长短

在实际中,对于分布式系统而言,网络问题是一个必定会出先的异常情况,因此分区容错性也就成为了一个分布式系统必须需要面对和解决的问题。因此系统架构设计师往往需要把精力花在如何根据业务特点在C(一致性)和A(可用性)之间寻求平衡。

2. BASE理论

BASE是Basically Available(基本可用)、Soft state(软状态)和Eventually consistent(最终一致性)三个词的缩写。BASE是对CAP中一致性和可用性权衡的结果,其来源于对大规模互联网系统分布式实践的总结,是基于CAP定理逐步演化而来的,其核心思想是即使无法做到强一致性(Strong consistency),但每个应用都可以根据自身的业务特点,采用适当的方式来使系统达到最终一致性。

2.1 基本可用

基本可用是指分布式系统在出现不可预测故障的时候,允许损失部分可用性——但请注意,这绝不等价于系统不可用。

  • 响应时间上的损失
  • 功能上的损失

2.2 弱状态

弱状态也成为软状态,和硬状态相对,是指允许系统中的数据存在中间状态,并认为该中间状态的存在不会影响系统的整体可用性,即允许系统在不同节点的数据副本之间进行数据同步的过程存在延迟。

2.3 最终一致性

最终一致性强调的是系统中所有的数据副本,在经过一段时间的同步后,最终能够达到一个一致的状态。因此,最终一致性的本质是需要系统保证最终数据能够达到一致,而不需要实时保证系统数据的强一致性。在没有发现故障的前提下,数据达到一致状态的时间延迟,取决于网络延迟、系统负载和数据复制方案设计等因素。

在实际工程实践中,最终一致性存在以下五类主要变种:

  • 因果一致性(Causal consistency)
    如果进程A在更新完某个数据项后通知了进程B,那么进程B之后对该数据项的访问就应该能够获取到进程A更新后的最新值,并且如果进程B要对该数据项进行更新操作的话,务必基于进程A更新后的最新值,即不能发生丢失更新情况。与此同时,与进程A无因果关系的进程C的数据访问则没有这样的限制。
  • 读己之所写(Read your writes)
    进程A更新一个数据项之后,它自己总是能够访问到更新过的最新值,而不会看到旧值。也就是说,对于单个数据获取者来说,其读取到的数据,一定不会自己上次写入的值旧。因此,读己之所写也可以看做是一种特殊的因果一致性。
  • 会话一致性(Session consistency)
    会话一致性将对系统数据的访问过程框定在一个会话当中:系统能够保证在同一个有效的会话中实现”读己之所写”的一致性,也就是说,执行更新操作之后,客户端能够在同一个会话中始终读取到该数据项的最新值。
  • 单调读一致性(Monotonic read consistency)
    单调读一致性是指如果一个进程从系统中读取一个数据项的某个值后,那么系统对于该进程后续的任何数据访问都不应该返回更旧的值。
  • 单调写一致性(Monotonic write consistency)
    单调写一致性是指,一个系统要能够保证来自同一个进程的写操作被顺序地执行。

2.4 最终一致性的应用

在现代关系型数据库中,大多都会采用同步和异步方式来实现主备数据复制技术。在同步的方式中,数据的复制过程通常是更新事务的一部分,因此在事务完成后,主备数据库的数据库就会达到一致。而在异步方式中,备库的更新往往会存在延时,这取决于事务日志在主备数据库中的传输时间长短。当然,无论是采用多次重试还是人为数据订正,关系型数据库还是能够保证最终数据达到一致。

2.5 BASE和ACID

BASE理论面向的是大型高可用可扩展的分布式系统,和传统事务的ACID特性是相反的,它往往不同于ACID的强一致性模型,而是提出通过牺牲强一致性来获得可用性,并允许数据在一段时间内是不一致的,但最终达到一致状态。但同时,在实际的分布式场景中,不同业务单元和组件对数据一致性的要求是不同的,因此在具体的分布式架构设计过程中,ACID特性和BASE理论往往又会结合在一起使用。

3. 参考资料

  1. 从Paxos到ZooKeeper——分布式一致性原理与实践
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值