【巡检问题分析与最佳实践】RDS MySQL 活跃线程数高问题

本文涉及的产品
云原生数据库 PolarDB MySQL 版,Serverless 5000PCU 100GB
云数据库 RDS MySQL,集群版 2核4GB 100GB
推荐场景:
搭建个人博客
RDS MySQL Serverless 基础系列,0.5-2RCU 50GB
简介: 活跃线程数或活跃连接数是衡量MySQL负载状态的关键指标,通常来说一个比较健康的实例活跃连接数应该低于10,对于一个高规格和高QPS的实例,一般活跃连接数可能也就20、30,如果出现几百、上千的活跃连接数,那说明肯定有SQL堆积和MySQL 响应变慢,严重时会引起实例雪崩,实例hang死,无法继续处理SQL请求。

活跃线程数或活跃连接数是衡量MySQL负载状态的关键指标,通常来说一个比较健康的实例活跃连接数应该低于10,对于一个高规格和高QPS的实例,一般活跃连接数可能也就20、30,如果出现几百、上千的活跃连接数,那说明肯定有SQL堆积和MySQL 响应变慢,严重时会引起实例雪崩,实例hang死,无法继续处理SQL请求。

查看活跃线程数

RDS控制台

RDS MySQL的控制台提供了多种查看活跃线程数的方法:

监控与报警

      在RDS控制台的“监控与报警”页中的“标准监控”->“引擎监控”下,可以查看实例的活跃线程数的监控:

1.png

数据库自治服务

在RDS控制台的“自治服务”->“性能趋势”->“会话管理”页中可以查看实例活跃会话数,如果这值特别高,说明实例会话有拥堵:

2.png

活跃线程数高问题分析

慢SQL堆积

如果监控发现活跃线程数容易升高,首先就是show processlist查看是否有慢SQL。如果扫描行数太多的慢SQL太多,容易导致活跃连接数升高。

可以通过自治服务”->“一键诊断”->“会话管理”查看当前真正执行的SQL,如果是慢SQL,可以选中会话,然后结束会话或通过SQL限流,降低慢SQL的影响。

3.png

CPU打满

CPU打满以后正常的SQL也会变慢,活跃线程数肯定会有堆积。CPU打满的原因和处理参考CPU高问题的文档。

table cache

table cache不够用的表象是大量的SQL处于Opening table状态,特别是高QPS或表很多的场景容易出现,需要调大table_open_cache(不需要重启)和table_open_cache_instances(需要重启)参数。      

MDL锁

MDL锁导致的活跃线程数高的表象是大量的SQL处于Waiting for table metadata lock 的状态,在DDL prepare和commit阶段,DDL语句需要获取元数据锁,如果有DDL的表上有未提交事务或慢SQL,会阻塞DDL,DDL又会阻塞其他的SQL,最终导致活跃线程数升高。Kill掉未提交事务、慢SQL或当前正在执行的DDL都可以解决。

行锁冲突

行锁冲突导致的活跃线程数的表现是Innodb_row_lock_waits和Innodb_row_lock_time状态指标升高。您可以通过“自治服务”->“性能趋势”->“行锁”查看这两个指标的监控:

4.png

也可以通过执行show engine innodb status查看是否有大量的处于Lock wait状态的session,如果有说明行锁冲突比较严重,业务上需要优化热点更新、减少事务大小、及时提交事务等方法避免行锁冲突。

相关实践学习
基于CentOS快速搭建LAMP环境
本教程介绍如何搭建LAMP环境,其中LAMP分别代表Linux、Apache、MySQL和PHP。
全面了解阿里云能为你做什么
阿里云在全球各地部署高效节能的绿色数据中心,利用清洁计算为万物互联的新世界提供源源不断的能源动力,目前开服的区域包括中国(华北、华东、华南、香港)、新加坡、美国(美东、美西)、欧洲、中东、澳大利亚、日本。目前阿里云的产品涵盖弹性计算、数据库、存储与CDN、分析与搜索、云通信、网络、管理与监控、应用服务、互联网中间件、移动服务、视频服务等。通过本课程,来了解阿里云能够为你的业务带来哪些帮助     相关的阿里云产品:云服务器ECS 云服务器 ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,助您降低 IT 成本,提升运维效率,使您更专注于核心业务创新。产品详情: https://www.aliyun.com/product/ecs
相关文章
|
10天前
|
网络协议 关系型数据库 MySQL
【最佳实践】MySQL数据库迁移到PXC集群
借本次数据库迁移实践,再次总结一下MySQL数据库迁移到PXC的最佳操作路径。
18 0
|
13天前
|
关系型数据库 数据库 RDS
利用DTS将自建mysql5.7版本数据库迁移至对应rds报错
利用DTS将自建mysql5.7版本数据库迁移至对应rds报错
39 0
|
1月前
|
SQL 存储 关系型数据库
精通MySQL:从基础到高级应用与最佳实践
第一章:MySQL基础入门 1.1 MySQL概述 介绍MySQL的历史、发展、优势以及应用领域
|
23天前
|
关系型数据库 MySQL 测试技术
《阿里云产品四月刊》—瑶池数据库微课堂|RDS MySQL 经济版 vs 自建 MySQL 性能压测与性价比分析
阿里云瑶池数据库云原生化和一体化产品能力升级,多款产品更新迭代
|
24天前
|
NoSQL Redis
Redis系列学习文章分享---第五篇(Redis实战篇--优惠券秒杀,全局唯一id 添加优惠券 实现秒杀下单 库存超卖问题分析 乐观锁解决超卖 实现一人一单功能 集群下的线程并发安全问题)
Redis系列学习文章分享---第五篇(Redis实战篇--优惠券秒杀,全局唯一id 添加优惠券 实现秒杀下单 库存超卖问题分析 乐观锁解决超卖 实现一人一单功能 集群下的线程并发安全问题)
26 0
|
26天前
|
关系型数据库 MySQL 调度
深入理解MySQL InnoDB线程模型
深入理解MySQL InnoDB线程模型
|
1月前
|
关系型数据库 MySQL 数据库
精通MySQL:数据库管理、性能优化与最佳实践
h3> 一、引言 MySQL是一个功能强大的开源关系型数据库管理系统,广泛应用于各种Web应用、企业级应用和数据分析等领域
|
2月前
|
关系型数据库 MySQL Java
实时计算 Flink版产品使用合集之同步MySQL数据到Hologres时,配置线程池的大小该考虑哪些
实时计算Flink版作为一种强大的流处理和批处理统一的计算框架,广泛应用于各种需要实时数据处理和分析的场景。实时计算Flink版通常结合SQL接口、DataStreamAPI、以及与上下游数据源和存储系统的丰富连接器,提供了一套全面的解决方案,以应对各种实时计算需求。其低延迟、高吞吐、容错性强的特点,使其成为众多企业和组织实时数据处理首选的技术平台。以下是实时计算Flink版的一些典型使用合集。
|
2月前
|
SQL 关系型数据库 MySQL
RDS for MySQL的DDL、DML和DQL
这篇文章介绍了MySQL中处理数据的几种主要操作:DDL(Data Definition Language),DML(Data Manipulation Language)和DQL(Data Query Language)。首先讲解了如何使用CREATE DATABASE, ALTER DATABASE和DROP DATABASE语句来创建、修改和删除数据库。
30 1
|
1月前
|
消息中间件 关系型数据库 MySQL
Flink CDC 最佳实践(以 MySQL 为例)
Flink CDC 最佳实践(以 MySQL 为例)
163 0

相关产品

  • 云数据库 RDS MySQL 版
  • 推荐镜像

    更多