Greenplum架构

架构概述

  • 基于PostgreSQL的分布式数据库,采用shared-nothing架构、主机、操作系统、内存、存储都是自我控制的,不存在共享
  • 采用了MPP,每个SMP节点运行自己的操作系统、数据库等,每个节点内的CPU不能访问另一个节点的内存,节点之间的信息交互是通过节点互联网络实现的(数据重分配)
  • master hostsegment hostinterconnect三大部分组成
  • 各个节点均可配置镜像节点,当主节点不可用时,自动切换至镜像节点,当主节点恢复并启动后,将自动同步变更,确保数据不丢失,实现数据库系统的高可用
  • 数据库中所有的表都是分布式的,每个segment会存放相应的数据片段,根据用户指定的hash key对表进行hash数据分布或者随机数据分布,或者复制表分布。当需要进行数据分析时,涉及到的segment同时工作,提升计算效率
  • 进行表关联或者group by时,当关联键与分布键不同时,即关联的相同值的行数据分布在不同的segment实例上,需要涉及到数据表的跨库关联
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
Greenplum数据库是一种面向数据仓库应用的关系型的MPP(大规模并行处理)数据库系统,基于PostgreSQL数据库开发。它在数据存储、高并发、高可用、线性扩展、易用性等方面具有明显的优势。借助MPP架构Greenplum能够在大型数据集上执行复杂SQL分析的速度比很多解决方案都要快。它还具有数据管理质量特性、升级和扩展能力,降低了大规模实时数据分析的门槛。相比于Map-Reduce,Greenplum的SQL语法简单、功能强大、易上手,使用和开发成本低,易于对接其他第三方数据分析工具。Greenplum采用了典型的Shared Nothing架构(MPP),每个节点只访问自己的本地资源,节点之间的信息交互通过节点高速互联网络实现。这种架构使得Greenplum具有大规模的并行处理能力。\[1\]\[2\]\[3\] #### 引用[.reference_title] - *1* [GreenPlum系列-1-概述](https://blog.csdn.net/weixin_42633805/article/details/129815585)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^insertT0,239^v3^insert_chatgpt"}} ] [.reference_item] - *2* *3* [Greenplum 数据库](https://blog.csdn.net/qq_22473611/article/details/123927398)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^insertT0,239^v3^insert_chatgpt"}} ] [.reference_item] [ .reference_list ]

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值