mysql show full processlist 分析问题 mysql服务器负载居高不下

show proceslist时发现大量的sleep,有什么风险吗,该如何处理?

(一)可能的风险有:
    1、大量sleep线程会占用连接数,当超过max_connections后,新连接无法再建立,业务不可用;
    2、这些sleep线程中,有些可能有未提交事务,可能还伴随着行锁未释放,有可能会造成严重锁等待;
    3、这些sleep线程中,可能仍有一些内存未释放,数量太多的话,是会消耗大量无谓的内存的,影响性能。



(二)建议应对措施:
    1、升级到5.7及以上版本,连接性能有所提升;
    2、采用MariaDB/Percona版本,根据情况决定是否启用thread pool功能;
    3、适当调低wait_timeout/interactive_timeout值,例如只比java连接池的timeout时间略高些即可;
    4、利用pt-kill或辅助脚本/工具巡查并杀掉无用sleep进程;
    5、利用5.7的新特性,适当设置max_execution_time阈值,消除长时间执行的SQL;
    6、定期检查show processlist的结果,找到长时间sleep的线程,根据host&port反推找到相关应用负责人,协商优化方案。

mysql服务器最近偶尔出现cpu百分百居高不下的情况,所以需要进行分析

兄弟命令    show processlist;只列出前100条,如果想全列出请使用show full processlist;

先 简单说一下各列的含义和用途:

           id列,不用说了吧,一个标识,你要kill一个语句的时候很有用。

       user列,显示单前用户,如果不是root,这 个命令就只显示你权限范围内的sql语句。

       host列,显示这个语句是从哪个ip的哪个端口上发出的。呵呵,可以用来追踪出问题语句的用户。

         db列,显示 这个进程目前连接的是哪个数据库。command列,显示当前连接的执行的命令,一般就是休眠(sleep),查询(query),连接 (connect)。

       time列,此这个状态持续的时间,单位是秒。

      state列,显示使用当前连接的sql语句的状态,很重要的列,后续会有所有的状态 的描述,请注意,state只是语句执行中的某一个状态,一个sql语句,已查询为例,可能需要经过copying to tmp table,Sorting result,Sending data等状态才可以完成,

      info列,显示这个sql语句,因为长度有限,所以长的sql语句就显示不全,但是一个判断问题语句的重要依据。

      这个命令中最关键的就是state列,mysql列出的状态主要有以下几种:

     Checking table 
     正在检查数据表(这是自动的)。 
     Closing tables 
正在将表中修改的数据刷新到磁盘中,同时正在关闭已经用完的表。这是一个很快的操作,如果不是这样的话,就应该确认磁盘空间是否已经满了或者磁盘是否正处于重负中。 
     Connect Out 
复制从服务器正在连接主服务器。 
    Copying to tmp table on disk 
由于临时结果集大于 tmp_table_size,正在将临时表从内存存储转为磁盘存储以此节省内存。 
    Creating tmp table 
正在创建临时表以存放部分查询结果。 
   deleting from main table 
服务器正在执行多表删除中的第一部分,刚删除第一个表。 
   deleting from reference tables 
服务器正在执行多表删除中的第二部分,正在删除其他表的记录。 
   Flushing tables 
正在执行 FLUSH TABLES,等待其他线程关闭数据表。 
   Killed 
发送了一个kill请求给某线程,那么这个线程将会检查kill标志位,同时会放弃下一个kill请求。MySQL会在每次的主循环中检查kill标志 位,不过有些情况下该线程可能会过一小段才能死掉。如果该线程程被其他线程锁住了,那么kill请求会在锁释放时马上生效。 
   Locked 
被其他查询锁住了。 
   Sending data 
正在处理 SELECT 查询的记录,同时正在把结果发送给客户端。 
   Sorting for group 
正在为 GROUP BY 做排序。 
   Sorting for order 
正在为 ORDER BY 做排序。 
   Opening tables 
这个过程应该会很快,除非受到其他因素的干扰。例如,在执 ALTER TABLE 或 LOCK TABLE 语句行完以前,数据表无法被其他线程打开。 正尝试打开一个表。 
   Removing duplicates 
正在执行一个 SELECT DISTINCT 方式的查询,但是MySQL无法在前一个阶段优化掉那些重复的记录。因此,MySQL需要再次去掉重复的记录,然后再把结果发送给客户端。 
   Reopen table 
获得了对一个表的锁,但是必须在表结构修改之后才能获得这个锁。已经释放锁,关闭数据表,正尝试重新打开数据表。 
   Repair by sorting 
修复指令正在排序以创建索引。 
   Repair with keycache 
修复指令正在利用索引缓存一个一个地创建新索引。它会比 Repair by sorting 慢些。 
   Searching rows for update 
正在讲符合条件的记录找出来以备更新。它必须在 UPDATE 要修改相关的记录之前就完成了。 
   Sleeping 
正在等待客户端发送新请求. 
   System lock 
正在等待取得一个外部的系统锁。如果当前没有运行多个 mysqld 服务器同时请求同一个表,那么可以通过增加 --skip-external-locking参数来禁止外部系统锁。 
  U pgrading lock 
INSERT DELAYED 正在尝试取得一个锁表以插入新记录。 
  Updating 
正在搜索匹配的记录,并且修改它们。 
  User Lock 
正在等待 GET_LOCK()。 
  Waiting for tables 
该线程得到通知,数据表结构已经被修改了,需要重新打开数据表以取得新的结构。然后,为了能的重新打开数据表,必须等到所有其他线程关闭这个表。以下几种 情况下会产生这个通知:FLUSH TABLES tbl_name, ALTER TABLE, RENAME TABLE, REPAIR TABLE, ANALYZE TABLE, 或 OPTIMIZE TABLE。 
  waiting for handler insert 
INSERT DELAYED 已经处理完了所有待处理的插入操作,正在等待新的请求。 
大部分状态对应很快的操作,只要有一个线程保持同一个状态好几秒钟,那么可能是有问题发生了,需要检查一下。 
还有其他的状态没在上面中列出来,不过它们大部分只是在查看服务器是否有存在错误是才用得着。

猜你喜欢

转载自blog.csdn.net/weixin_46742102/article/details/109641096