Clickhouse集群3节点2副本搭建

因公司服务器资源有限,现需要在3台服务器上搭建3节点2副本的Clickhouse集群。在每台服务器上需安装两个clickhouse实例。
一:Clickhouse安装(3台服务器上)1.下载clickhouse相关安装包,忽略依赖关系强制安装rpm -ivh clickhouse-client-19.16.3.6-1.el7.x86_64.rpm --nodepsrpm -ivh clickhouse-common-static-19.16.3.6-1.el7.x86_64.rpm --nodepsrpm -ivh clickhouse-server-19.16.3.6-1.el7.x86_64.rpm --nodepsrpm -ivh clickhouse-server-common-19.16…6-1.el7.x86_64.rpm --nodeps2:查看状态,并设置开机自启systemctl status clickhouseservice clickhouse-server start/sbin/chkconfig clickhouse-server on3:修改/etc/clickhouse-server/user.xml和/etc/clickhouse-server/config.xml文件user.xml:可配置用户相关权限和配额等。开启外网访问:修改config.xml, 找到 listen_host 标签位置,添加如下:<listen_host>::1</listen_host> <listen_host>0.0.0.0</listen_host> 取消大表删除限制 Clickhouse默认大于50GB的MergeTree表无法通过drop删除,要取消该限制,只需取消config.xml中以下两行的注释: <max_table_size_to_drop>0</max_table_size_to_drop><max_partition_size_to_drop>0</max_partition_size_to_drop>4.第二个Clickhouse实例配置(1)复制Clickhouse启动脚本: cp /etc/init.d/clickhouse-server /etc/init.d/clickhouse-server2(2)更改clickhouse-server2: CLICKHOUSE_CONFIG= C L I C K H O U S E C O N F D I R / c o n f i g 1. x m l C L I C K H O U S E P I D F I L E = " CLICKHOUSE_CONFDIR/config1.xml CLICKHOUSE_PIDFILE=" CLICKHOUSECONFDIR/config1.xmlCLICKHOUSEPIDFILE="CLICKHOUSE_PIDDIR/$PROGRAM-1.pid"(3)复制Clickhouse配置文件: cp /etc/clickhouse-server/config.xml /etc/clickhouse-server/config1.xml(4)更改config1.xml: 修改日志文件路径: /var/log/clickhouse-server/clickhouse-server1.log /var/log/clickhouse-server/clickhouse- server.err1.log 修改端口号: <http_port>8124</http_port> <tcp_port>9001</tcp_port> <interserver_http_port>9010</interserver_http_port> 修改数据文件和temp目录路径: /var/lib/clickhouse2/ <tmp_path>/var/lib/clickhouse2/tmp/</tmp_path> 修改metrika.xml文件路径: <include_from>/etc/clickhouse-server/metrica.xml</include_from>二:Clickhouse集群配置为了Clickhouse集群实现高可用,需先安装Zookeeper。1.zookeeper集群搭建 ( 1 )下载zookeeper-3.4.10安装到/opt/module/目录下 ( 2 )同步/opt/module/zookeeper-3.4.10目录内容到另外两台服务器 ( 3 )配置服务器编号:①在/opt/module/zookeeper-3.4.10/这个目录下创建zkData
②在/opt/module/zookeeper-3.4.10/zkData目录下创建一个myid的文件
③编辑myid文件,在文件中添加与server对应的编号。
④拷贝配置好的zookeeper到其他机器上,并分别在另外两台服务器上修改myid.三台机器必须不同。
( 4 )配置zoo.cfg文件
①重命名/opt/module/zookeeper-3.4.10/conf这个目录下的zoo_sample.cfg为zoo.cfg
②打开zoo.cfg文件,修改数据存储路径配置
dataDir=/opt/module/zookeeper-3.4.10/zkData
增加如下配置
#######################cluster##########################
server.A1=B1:2888:3888
server.A2=B2:2888:3888
server.A3=B3:2888:3888

A是一个数字,表示这个是第几号服务器,和配置文件myid中相同;
B是这个服务器的地址;
2888是这个服务器Follower与集群中的Leader服务器交换信息的端口;
3888是万一集群中的Leader服务器挂了,需要一个端口来重新进行选举,选出一个新的Leader,而这个端口就是用来执行选举时服务器相互通信的端口。
③同步zoo.cfg配置文件,启动集群。
/opt/module/zookeeper-3.4.10/bin/zkServer.sh start
2.Clickhouse配置文件的修改
(1) 修改config.xml文件:
<listen_host>::</listen_host>
(2) 在三台机器的/etc目录下新建metrika.xml文件。
在metraka.xml中配置集群有几个分片,几个副本。以及每个分片和副本的数据应放在什么地方。(三台服务器上的两个clickhouse实例配置都有所不同)
完毕!

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
数据分析职业是一个多金的职业,数据分析职位是一个金饭碗的职位,前景美好,但是要全面掌握大数据分析技术,非常困难,大部分学员的痛点是不能快速找到入门要点,精准快速上手。本课程采用项目驱动的方式,以Spark3和Clickhouse技术为突破口,带领学员快速入门Spark3+Clickhouse数据分析,促使学员成为一名高效且优秀的大数据分析人才。学员通过本课程的学习,不仅可以掌握使用Python3进行Spark3数据分析,还会掌握利用Scala/java进行Spark数据分析,多语言并进,力求全面掌握;另外通过项目驱动,掌握Spark框架的精髓,教导Spark源码查看的技巧;会学到Spark性能优化的核心要点,成为企业急缺的数据分析人才;更会通过Clickhouse和Spark搭建OLAP引擎,使学员对大数据生态圈有一个更加全面的认识和能力的综合提升。真实的数据分析项目,学完即可拿来作为自己的项目经验,增加面试谈薪筹码。课程涉及内容:Ø  Spark内核原理(RDD、DataFrame、Dataset、Structed Stream、SparkML、SparkSQL)Ø  Spark离线数据分析(千万简历数据分析、雪花模型离线数仓构建)Ø  Spark特征处理及模型预测Ø  Spark实时数据分析(Structed Stream)原理及实战Ø  Spark+Hive构建离线数据仓库(数仓概念ODS/DWD/DWS/ADS)Ø  Clickhouse核心原理及实战Ø  Clickhouse engine详解Ø  Spark向Clickhouse导入简历数据,进行数据聚合分析Ø  catboost训练房价预测机器学习模型Ø  基于Clickhouse构建机器学习模型利用SQL进行房价预测Ø  Clickhouse集群监控,Nginx反向代理Grafana+Prometheus+Clickhouse+node_exporterØ  Spark性能优化Ø  Spark工程师面试宝典       课程组件:集群监控:福利:本课程凡是消费满359的学员,一律送出价值109元的实体书籍.

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值