【巡检问题分析与最佳实践】RDS MySQL 活跃线程数高问题

本文涉及的产品
云原生数据库 PolarDB 分布式版,标准版 2核8GB
RDS MySQL Serverless 基础系列,0.5-2RCU 50GB
RDS PostgreSQL Serverless,0.5-4RCU 50GB 3个月
推荐场景:
对影评进行热评分析
简介: 活跃线程数或活跃连接数是衡量MySQL负载状态的关键指标,通常来说一个比较健康的实例活跃连接数应该低于10,对于一个高规格和高QPS的实例,一般活跃连接数可能也就20、30,如果出现几百、上千的活跃连接数,那说明肯定有SQL堆积和MySQL 响应变慢,严重时会引起实例雪崩,实例hang死,无法继续处理SQL请求。

活跃线程数或活跃连接数是衡量MySQL负载状态的关键指标,通常来说一个比较健康的实例活跃连接数应该低于10,对于一个高规格和高QPS的实例,一般活跃连接数可能也就20、30,如果出现几百、上千的活跃连接数,那说明肯定有SQL堆积和MySQL 响应变慢,严重时会引起实例雪崩,实例hang死,无法继续处理SQL请求。

查看活跃线程数

RDS控制台

RDS MySQL的控制台提供了多种查看活跃线程数的方法:

监控与报警

      在RDS控制台的“监控与报警”页中的“标准监控”->“引擎监控”下,可以查看实例的活跃线程数的监控:

1.png

数据库自治服务

在RDS控制台的“自治服务”->“性能趋势”->“会话管理”页中可以查看实例活跃会话数,如果这值特别高,说明实例会话有拥堵:

2.png

活跃线程数高问题分析

慢SQL堆积

如果监控发现活跃线程数容易升高,首先就是show processlist查看是否有慢SQL。如果扫描行数太多的慢SQL太多,容易导致活跃连接数升高。

可以通过自治服务”->“一键诊断”->“会话管理”查看当前真正执行的SQL,如果是慢SQL,可以选中会话,然后结束会话或通过SQL限流,降低慢SQL的影响。

3.png

CPU打满

CPU打满以后正常的SQL也会变慢,活跃线程数肯定会有堆积。CPU打满的原因和处理参考CPU高问题的文档。

table cache

table cache不够用的表象是大量的SQL处于Opening table状态,特别是高QPS或表很多的场景容易出现,需要调大table_open_cache(不需要重启)和table_open_cache_instances(需要重启)参数。      

MDL锁

MDL锁导致的活跃线程数高的表象是大量的SQL处于Waiting for table metadata lock 的状态,在DDL prepare和commit阶段,DDL语句需要获取元数据锁,如果有DDL的表上有未提交事务或慢SQL,会阻塞DDL,DDL又会阻塞其他的SQL,最终导致活跃线程数升高。Kill掉未提交事务、慢SQL或当前正在执行的DDL都可以解决。

行锁冲突

行锁冲突导致的活跃线程数的表现是Innodb_row_lock_waits和Innodb_row_lock_time状态指标升高。您可以通过“自治服务”->“性能趋势”->“行锁”查看这两个指标的监控:

4.png

也可以通过执行show engine innodb status查看是否有大量的处于Lock wait状态的session,如果有说明行锁冲突比较严重,业务上需要优化热点更新、减少事务大小、及时提交事务等方法避免行锁冲突。

相关实践学习
如何在云端创建MySQL数据库
开始实验后,系统会自动创建一台自建MySQL的 源数据库 ECS 实例和一台 目标数据库 RDS。
全面了解阿里云能为你做什么
阿里云在全球各地部署高效节能的绿色数据中心,利用清洁计算为万物互联的新世界提供源源不断的能源动力,目前开服的区域包括中国(华北、华东、华南、香港)、新加坡、美国(美东、美西)、欧洲、中东、澳大利亚、日本。目前阿里云的产品涵盖弹性计算、数据库、存储与CDN、分析与搜索、云通信、网络、管理与监控、应用服务、互联网中间件、移动服务、视频服务等。通过本课程,来了解阿里云能够为你的业务带来哪些帮助     相关的阿里云产品:云服务器ECS 云服务器 ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,助您降低 IT 成本,提升运维效率,使您更专注于核心业务创新。产品详情: https://www.aliyun.com/product/ecs
相关文章
|
3月前
|
SQL 关系型数据库 MySQL
MySQL 8.0:filesort 性能退化的问题分析
用户将 RDS MySQL 实例从 5.6 升级到 8.0 后,发现相同 SQL 的执行时间增长了十几倍。本文就该问题逐步展开排查,并最终定位根因。
|
4月前
|
监控 Java 测试技术
Java并发编程最佳实践:设计高性能的多线程系统
Java并发编程最佳实践:设计高性能的多线程系统
66 1
|
20天前
|
安全 Java 编译器
Java多线程编程的陷阱与最佳实践####
【10月更文挑战第29天】 本文深入探讨了Java多线程编程中的常见陷阱,如竞态条件、死锁、内存一致性错误等,并通过实例分析揭示了这些陷阱的成因。同时,文章也分享了一系列最佳实践,包括使用volatile关键字、原子类、线程安全集合以及并发框架(如java.util.concurrent包下的工具类),帮助开发者有效避免多线程编程中的问题,提升应用的稳定性和性能。 ####
46 1
|
2月前
|
关系型数据库 MySQL 数据库
MySQL数据库:基础概念、应用与最佳实践
一、引言随着互联网技术的快速发展,数据库管理系统在现代信息系统中扮演着核心角色。在众多数据库管理系统中,MySQL以其开源、稳定、可靠以及跨平台的特性受到了广泛的关注和应用。本文将详细介绍MySQL数据库的基本概念、特性、应用领域以及最佳实践,帮助读者更好地理解和应用MySQL数据库。二、MySQL
123 5
|
2月前
|
设计模式 监控 安全
Python多线程编程:特性、挑战与最佳实践
Python多线程编程:特性、挑战与最佳实践
39 0
|
2月前
|
设计模式 监控 安全
Python多线程编程:特性、挑战与最佳实践【1】
Python多线程编程:特性、挑战与最佳实践【1】
34 0
|
4月前
|
前端开发 JavaScript 大数据
React与Web Workers:开启前端多线程时代的钥匙——深入探索计算密集型任务的优化策略与最佳实践
【8月更文挑战第31天】随着Web应用复杂性的提升,单线程JavaScript已难以胜任高计算量任务。Web Workers通过多线程编程解决了这一问题,使耗时任务独立运行而不阻塞主线程。结合React的组件化与虚拟DOM优势,可将大数据处理等任务交由Web Workers完成,确保UI流畅。最佳实践包括定义清晰接口、加强错误处理及合理评估任务特性。这一结合不仅提升了用户体验,更为前端开发带来多线程时代的全新可能。
84 1
|
4月前
|
安全 Java UED
Java线程池的实现原理及其在业务中的最佳实践
本文讲述了Java线程池的实现原理和源码分析以及线程池在业务中的最佳实践。
|
4月前
|
消息中间件 监控 Java
最佳实践|一文讲解端线程死循环的治理
本文旨在介绍钉钉 Android 团队死循环检测工具建设的思路和典型案例的修复历程。希望通过此次分享,对同样面临类似死循环问题的团队能够有所启发。
|
4月前
|
存储 缓存 安全
深度剖析Java HashMap:源码分析、线程安全与最佳实践
深度剖析Java HashMap:源码分析、线程安全与最佳实践

相关产品

  • 云数据库 RDS MySQL 版
  • 云数据库 RDS