当master down掉后，pt-heartbeat不断重试会导致内存缓慢增长的原因及解决办法

Karli ·

更新时间:2024-11-13

· 596 次阅读

最近同事反映，在使用pt-heartbeat监控主从复制延迟的过程中，如果master down掉了，则pt-heartbeat则会连接失败，但会不断重试。

重试本无可厚非，毕竟从使用者的角度来说，希望pt-heartbeat能不断重试，直到重新连接上数据库。但是，他们发现，不断的重试会带来内存的缓慢增长。

重现

环境：

pt-heartbeat v2.2.19，MySQL社区版 v5.6.31，Perl v5.10.1，RHEL 6.7，内存500M

为了避免数据库启停对pt-heartbeat内存使用率的影响，故MySQL和pt-heartbeat分别运行在不同的主机上。

运行pt-heartbeat

# pt-heartbeat --update -h 192.168.244.10 -u monitor -p monitor123 -D test --create-table

监控pt-heartbeat的内存使用率

获取pid


# ps -ef |grep pt-heartbeat
root 1505 1471 0 19:13 pts/0 00:00:08 perl /usr/local/bin/pt-heartbeat --update -h 192.168.244.10 -u monitor -p monitor123 -D test --create-table
root 1563 1545 2 19:50 pts/3 00:00:00 grep pt-heartbeat

查看该进程的内存使用率

# top -p 1505

运行了0:15.00（TIME+列），MEM一直稳定在3.3%

现关闭数据库

# service mysqld stop

刚才的pt-heartbeat命令不断输出以下信息

同样CPU时间后，MEM增长到4.4%，增长了1%，考虑到内存500M，该进程的内存占用增加了5M，虽然不是很多，但考虑到进程的内存增加并没有停止的意思，这个现象还是要引起注意的。

同时，通过pmap命令，发现，0000000001331000地址的RSS和Dirry也会增长，增长的速率是4k/s

后来研究pt-heartbeat的源码，才发现代码有点bug


my $tries = 2;
while ( !$dbh && $tries-- ) {
PTDEBUG && _d($cxn_string, ' ', $user, ' ', $pass,
join(', ', map { "$_=>$defaults->{$_}" } keys %$defaults ));
$dbh = eval { DBI->connect($cxn_string, $user, $pass, $defaults) };
if ( !$dbh && $EVAL_ERROR ) {
if ( $EVAL_ERROR =~ m/locate DBD/mysql/i ) {
die "Cannot connect to MySQL because the Perl DBD::mysql module is "
. "not installed or not found. Run 'perl -MDBD::mysql' to see "
. "the directories that Perl searches for DBD::mysql. If "
. "DBD::mysql is not installed, try:n"
. " Debian/Ubuntu apt-get install libdbd-mysql-perln"
. " RHEL/CentOS yum install perl-DBD-MySQLn"
. " OpenSolaris pgk install pkg:/SUNWapu13dbd-mysqln";
}
elsif ( $EVAL_ERROR =~ m/not a compiled character set|character set utf8/ ) {
PTDEBUG && _d('Going to try again without utf8 support');
delete $defaults->{mysql_enable_utf8};
}
if ( !$tries ) {
die $EVAL_ERROR;
}
}
}

以上代码摘自get_dbh函数，用于获取数据库的连接，如果获取失败，则重试1次，然后通过die函数抛异常退出。

但是，通过设置如下断点，发现当$tries为0时，if函数里面的PTDEBUG && _d("$EVAL_ERROR")语句能执行，但die函数就是没有抛出异常，并退出脚本


PTDEBUG && _d($tries);
if ( !$tries ) {
PTDEBUG && _d("$EVAL_ERROR"); 
die $EVAL_ERROR; }

后来，将上述代码的最后一个if函数修改如下：


if ( !$tries ) {
die "test:$EVAL_ERROR";
}

再次测试

启动数据库

# service mysqld start

执行pt-heartbeat命令

# pt-heartbeat --update -h 192.168.244.10 -u monitor -p monitor123 -D test --create-table

停止数据库

# service mysqld stop

刚才执行的pt-heartbeat命令异常退出

“test:”就是加入的测试字符。

结论

很奇怪，只是单纯的die $EVAL_ERROR不会抛出异常，并退出脚本，但修改后的die "test:$EVAL_ERROR"却会退出脚本。

很显然，这确实是个bug，不知道是不是与perl的版本有关。

很好奇，失败的连接如何导致内存的不断增长？

最后，给percona官方提了个bug

https://bugs.launchpad.net/percona-toolkit/+bug/1629164

以上所述是小编给大家介绍的当master down掉后，pt-heartbeat不断重试会导致内存缓慢增长的原因及解决办法，希望对大家有所帮助，如果大家有任何疑问欢迎给我留言，小编会及时回复大家的！

您可能感兴趣的文章:详解spring boot使用@Retryable来进行重处理Spring Cloud重试机制与各组件的重试总结详解Spring Cloud Zuul重试机制探秘Java编程Retry重试机制实例详解

heartbeat pt master down

1024 个赞

需要登录后方可回复, 如果你还没有账号请注册新账号

Go 语言教程

Selena 2021-05-05

953

Bootstrap4 列表组

Agatha 2021-05-22

929

用html5绘制折线图的实例代码

Maren 2020-03-31

826

html5 canvas fillRect坐标和大小的问题解决方法

Ramya 2020-04-22

642

Nginx content阶段 http-concat-master模块提升多个小文件性能

Kersen 2020-03-27

711

k8s，盘他！k8s多master节点使用二进制部署实操

Wilona 2021-06-03

826

成为计算几何master之路——记算法竞赛中常用的计几算法及思想

Mathilda 2020-06-02

672

小程序websocket心跳库(websocket-heartbeat-miniprogram)

Hana 2020-03-23

702

phpinfo() 中 Local Value（局部变量）Master Value（主变量）的区别

Gamila 2021-03-17

656

浅谈pytorch 模型 .pt, .pth, .pkl的区别及模型保存方式

Dianne 2020-07-04

945

k8s node节点重新加入master集群的实现

Dianthe 2021-12-13

441

MySQL的从库Seconds_Behind_Master延迟总结

Zada 2021-12-16

1287

MySQL 发生同步延迟时Seconds_Behind_Master还为0的原因

Madeline 2021-12-16

1933

详解MySQL的Seconds_Behind_Master

Bambi 2021-12-16

MySQL pt-slave-restart工具的使用简介

Fronde 2021-12-16

781

MongoDb的not master and slaveok=false错误及解决方法

Valentina 2021-12-16

1592

电脑开机蓝屏显示please power down等英文该怎么办?

Catherine 2022-02-27

1361

玩CF出现Error in InitRenderer().Shutting down的解决大全(xp,win7等)

Bliss 2022-03-10

1514

Redis实现主从复制方式(Master&Slave)

Erin 2022-06-20

956

关于pt-archiver和自增主键的那些事

Angie 2022-07-15

855

我要提问

致谢

帮助他人，成就自己。

人生最大成功就是伸出热情而温暖的双手，尽自己所能去帮助身边的每一个人，只要无私的奉献，就会收获到美好的生活。

1024问感谢每一位朋友的帮助和支持。

软件开发网提供编程的基础软件技术培训教程,软件开发编程实例讲解Go,Node,HTML,CSS,Javascript,Python,Java,Ruby,C,PHP,MySQL等软件开发编程语言以及数据开发的基础知识，也提供大量的软件开发在线实例、从入门到精通就在1024问。

育儿网微养生全球行美食街育儿菜谱大全海南旅游女性养狗百科星座