Tdengine 3节点集群中有一个节点重启后,剩余2个节点的vgroup leader分布严重不均衡,昨晚轮流重启了2台机器,vgroup leader分布都是 0、3、6。

【TDengine 使用环境】
生产环境 /测试/ Poc/预生产环境

【TDengine 版本】3.3.6.13

【操作系统以及版本】

【部署方式】非容器部署

【集群节点数】3

【集群副本数】3

【描述业务影响】

【问题复现路径/shan】

【遇到的问题:问题现象及影响】tdengine 3节点集群中有一个节点重启后,剩余2个节点的vgroup leader分布严重不均衡,昨晚轮流重启了2台机器,vgroup leader分布都是 0、3、6。

【资源配置】8c 16G

【报错完整截图】

OSS开源版只能重启,依据 raft 协议进行选举。
但企业版支持手动对 数据库,或 指定 vgroup 进行选主,从而达到负载均衡的目的。

请教下,目前我这边也碰到了同样问题;社区版搭建的三节点集群,重启节点后,现在有一个节点(例如node2)全是follower副本,所有业务负载全部落在另两个节点上了;
查了各种资料,也包括对node2进行再次重启,该节点下还是全部是follower副本,根本不会再次选举成leader副本,社区版本也不支持手工balance的命令。
如有方法还请指导一下

单独重启一个节点是不会进行leader 重选的。只有超过半数节点才行。

对于社区版,那就能是同时重启所有节点,才会发生重新选主,才有可能在各个节点上都有分布leader。

好的,再请教一下: 目前集群是3节点,可以同时restart两个节点让这两个节点同时offline然后再ready,保障restart过程中至少有一个节点在线提供服务,这样可以触发重选leader吗?

只有一个节点在线是无法提供服务的。根据 raft 协议,只有超过半数的节点在线正常才能提供服务。

好的 那就只能停服三节点重启了