作者:杨文
DBA,负责客户项目的需求与维护,没有擅长,会点数据库,不限于MySQL、Redis、Cassandra、GreenPlum、ClickHouse、Elastic、TDSQL等等。
本文来源:原创投稿
*爱可生开源社区出品,原创内容未经授权不得随意使用,转载请联系小编并注明来源。
1、背景
客户测试环境Greenplum集群中,standby节点数据目录被误删除,导致standby节点不可用。如果此时由于其它各种原因导致master节点也不可用,则集群将无法对外提供服务,因此现需尽快恢复standby节点。
2、Greenplum集群架构简单介绍

1)库由Master Severs和Segment Severs组成。
2)Master Server:
- Greenplum数据库的Master是整个Greenplum数据库系统的入口,它接受连接和SQL查询并且把工作分布到Segment实例上。
- Master是全局系统目录的所在地。存储全局系统元数据信息。
- Master会认证客户端连接、处理到来的SQL命令、在Segment之间分布工作负载、协调每一个Segment返回的结果以及把最终结果呈现给客户端程序。
3)Segment Severs:
- Greenplum数据库的Segment实例是独立的数据库,每一个都存储了数据的一部分并且执行查询处理的主要部分。
- 用户定义的表及其索引会分布在Greenplum数据库系统中可用的Segment上,每一个Segment都包含数据的不同部分。服务于Segment数据的数据库服务器进程运行在相应的Segment实例之下。用户通过Master与一个Greenplum数据库系统中的Segment交互。
- 当某个segment宕掉后,启用对应的mirror segment提供服务,保证数据不丢失。
3、本地模拟客户环境:
3.1、本地Greenplum集群环境:
- 1台Master;
- 1台standby Master;
- 5台segment计算节点,每个节点4个段,每个段有镜像,一共是40个段。
3.2、模拟master standby坏掉:
[root@standby01 ~]$ su - gpadmin
[gpadmin@standby01 ~]$ rm -rf /greenplum/gpdata/master/*
[gpadmin@standby01 ~]$ exit
[root@standby01 ~]$ reboot
[root@standby01 ~]$ su - gpadmin
[gpadmin@standby01 ~]$ ps -ef |grep postgres
gpadmin 17372 17298 0 18:47 pts/0 00:00:00 grep --color=auto postgres
[gpadmin@standby01 ~]$ cd /greenplum/gpdata/master/
[gpadmin@standby01 master]$ ll
总用量 0
4、故障分析及解决:
4.1、检查状态:
[gpadmin@master01 ~]$ gpstate

本文介绍了如何在Greenplum集群中恢复被误删数据目录的standby节点,包括清除故障配置、重新初始化standby库及确认集群状态等步骤。
最低0.47元/天 解锁文章
361

被折叠的 条评论
为什么被折叠?



