发明名称 |
处理至少一个分布式集群中的故障的方法、设备和系统 |
摘要 |
本发明实施例提供一种处理至少一个分布式集群中的故障的方法、设备和系统,至少一个分布式集群包括第一分布式集群,第一分布式集群中包括第一Master节点和第一Slave节点,第一参考节点,以及作为第一Master节点的备份的第一备用节点,第一备用节点接收第一参考节点发送的包括用于指示第一参考节点与第一Master节点处于失联状态的第一指示信息的心跳消息;第一备用节点根据第一指示信息,确定第一参考节点与第一Master节点处于失联状态;第一备用节点在检测到第一Master节点向第一备用节点发送的心跳消息中断的情况下,确定第一备用节点与第一Master节点也处于失联状态;第一备用节点确定该第一Master节点发生故障。在本发明实施例中,能够有效缩短故障检测时间。 |
申请公布号 |
CN105991325A |
申请公布日期 |
2016.10.05 |
申请号 |
CN201510068053.1 |
申请日期 |
2015.02.10 |
申请人 |
华为技术有限公司 |
发明人 |
袁健清;倪绍基 |
分类号 |
H04L12/24(2006.01)I;H04L1/22(2006.01)I |
主分类号 |
H04L12/24(2006.01)I |
代理机构 |
北京龙双利达知识产权代理有限公司 11329 |
代理人 |
毛威;肖鹂 |
主权项 |
一种处理至少一个分布式集群中的故障的方法,所述至少一个分布式集群包括第一分布式集群,所述第一分布式集群中包括第一Master节点和第一Slave节点,其特征在于,所述分布式集群还包括第一参考节点,以及作为所述第一Master节点的备份的第一备用节点,所述方法包括:所述第一备用节点接收所述第一参考节点发送的心跳消息,所述心跳消息包括用于指示所述第一参考节点与所述第一Master节点处于失联状态的第一指示信息;所述第一备用节点根据所述第一指示信息,确定所述第一参考节点与所述第一Master节点处于失联状态;所述第一备用节点检测所述第一Master节点向所述第一备用节点发送的心跳消息是否中断;在检测到所述第一Master节点向所述第一备用节点发送的心跳消息中断的情况下,所述第一备用节点确定所述第一备用节点与所述第一Master节点也处于失联状态;所述第一备用节点确定与所述第一备用节点和所述第一参考节点均失联的所述第一Master节点发生故障。 |
地址 |
518129 广东省深圳市龙岗区坂田华为总部办公楼 |