跳转至社区连接:https://asktug.com/t/topic/903526
tikv节点从3个扩容到5个以后,Store Region score一直处于上下波动的状态,导致apply log 和 append log的时间翻了好几倍。
尝试了几次,把tikv缩容到3个节点就没有这个问题,扩到5个节点又出现。 应该怎么解决,或者排查思路
【 TiDB 使用环境】线上 【 TiDB 版本】 4.0.10
调度在几天前就完成了,region的数量本来就不高,扩容后一个小时左右就完成了
业务高峰的时候,查询量上升比较多,写的量也不大的
“把tikv缩容到3个节点就没有这个问题,扩到5个节点又出现”,TiKV节点的配置是否相同?尤其是磁盘IO能力
5台TiKV里面,有两个规格的容量,IO能力是一样的
通过监控发现有空region,修改了split-region-on-table,enable-cross-table-merge,并把各个tikv的磁盘容量做了统一,效过还是不太明显
移除了热点region的调度,scheduler remove balance-hot-region-scheduler,各个tikv节点的region调度就不再那么多了,稳定下来,apply log 的时间也从256-512ms降低到了64-128ms,但是跟没有扩容之前的16-32ms相比,还是上升了不少
关闭了热点调度后,region的调度监控不再那么杂乱无章
没安装mirro,昨天下午15点多关闭了热点调度,到了晚上20点左右,apply log的时间和查询响应时间就恢复到了扩容前的水平了,挺奇怪的,tikv从3个扩容到5个会有多出来那么多的热点调度
「喜欢这篇文章,您的关注和赞赏是给作者最好的鼓励」
关注作者
【版权声明】本文为墨天轮用户原创内容,转载时必须标注文章的来源(墨天轮),文章链接,文章作者等基本信息,否则作者和墨天轮有权追究责任。如果您发现墨天轮中有涉嫌抄袭或者侵权的内容,欢迎发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。




