mysql prepare原理

本文涉及的产品
云数据库 RDS MySQL,集群系列 2核4GB
推荐场景:
搭建个人博客
RDS SQL Server Serverless,2-4RCU 50GB 3个月
推荐场景:
RDS MySQL Serverless 基础系列,0.5-2RCU 50GB
简介: mysql prepare 原理

注:2013年的老文章

Prepare的作用 

    Prepare SQL产生的原因。首先从mysql服务器执行sql的过程开始讲起,SQL执行过程包括以下阶段 词法分析->语法分析->语义分析->执行计划优化->执行。词法分析->语法分析这两个阶段我们称之为硬解析。词法分析识别sql中每个词,语法分析解析SQL语句是否符合sql语法,并得到一棵语法树(Lex对于只是参数不同,其他均相同的sql,它们执行时间不同但硬解析的时间是相同的。而同一SQL随着查询数据的变化,多次查询执行时间可能不同,但硬解析的时间是不变的。对于sql执行时间较短,sql硬解析的时间占总执行时间的比率越高。而对于淘宝应用的绝大多数事务型SQL,查询都会走索引,执行时间都比较短。因此淘宝应用db sql硬解析占的比重较大。 

    Prepare的出现就是为了优化硬解析的问题。Prepare在服务器端的执行过程如下

 1)  Prepare 接收客户端带”?”sql, 硬解析得到语法树(stmt->Lex), 缓存在线程所在的preparestatement cache中。此cache是一个HASH MAP. Keystmt->id. 然后返回客户端stmt->id等信息。

 2)  Execute 接收客户端stmt->id和参数等信息。注意这里客户端不需要再发sql过来。服务器根据stmt->idpreparestatement cache中查找得到硬解析后的stmt, 并设置参数,就可以继续后面的优化和执行了。

    Prepareexecute阶段可以节省硬解析的时间。如果sql只执行一次,且以prepare的方式执行,那么sql执行需两次与服务器交互(Prepareexecute而以普通(非prepare)方式,只需要一次交互。这样使用prepare带来额外的网络开销,可能得不偿失。我们再来看同一sql执行多次的情况,比如以prepare方式执行10次,那么只需要一次硬解析。这时候  额外的网络开销就显得微乎其微了。因此prepare适用于频繁执行的SQL

    Prepare的另一个作用是防止sql注入,不过这个是在客户端jdbc通过转义实现的,跟服务器没有关系。 

硬解析的比重

   交易买家库 tcbyer压测时,通过perf 得到的结果。

   


   硬解析相关的函数比重都比较靠前(MYSQLparse 4.93%, lex_one_token 1.79%, lex_start 1.12%)总共接近8%。因此,服务器使用prepare是可以带来较多的性能提升的。

jdbc与prepare 

  jdbc服务器端的参数:

   useServerPrepStmts:默认为false. 是否使用服务器prepare开关

  jdbc客户端参数:

   cachePrepStmts:默认false.是否缓存prepareStatement对象。每个连接都有一个缓存,是以sql为唯一标识的LRU cache. 同一连接下,不同stmt可以不用重新创建prepareStatement对象。

   prepStmtCacheSize:LRU cacheprepareStatement对象的个数。一般设置为最常用sql的个数。

   prepStmtCacheSqlLimit:prepareStatement对象的大小。超出大小不缓存。

  Jdbcprepare的处理过程: 

  useServerPrepStmts=true时Jdbc对prepare的处理

   1)  创建PreparedStatement对象,向服务器发送COM_PREPARE命令,并传送带问号的sql. 服务器返回jdbc stmt->id等信息

   2)  向服务器发送COM_EXECUTE命令,并传送参数信息。

  useServerPrepStmts=false时Jdbc对prepare的处理

   1)  创建PreparedStatement对象,此时不会和服务器交互。

   2) 根据参数和PreparedStatement对象拼接完整的SQL,向服务器发送QUERY命令

   我们再看参数cachePrepStmts打开时在useServerPrepStmts为true或false时,均缓存PreparedStatement对象。只不过useServerPrepStmts为的true缓存PreparedStatement对象包含服务器的stmt->id等信息,也就是说如果重用了PreparedStatement对象,那么就省去了和服务器通讯(COM_PREPARE命令)的开销。而useServerPrepStmts=false是,开启cachePrepStmts缓存PreparedStatement对象只是简单的sql解析信息,因此此时开启cachePrepStmts意义不是太大。

我们来开看一段java代码

1
2
3
4
5
6
7
8
9
10
11
             Connection con =  null ;
             PreparedStatement ps =  null ;
             String sql =  "select * from user where id=?" ;
             ps = con.prepareStatement(sql);            
             ps.setInt( 1 1 );‍‍            
             ps.executeQuery();            
             ps.close();            
             ps = con.prepareStatement(sql);            
             ps.setInt( 1 3 );            
             ps.executeQuery();            
             ps.close();

   这段代码在同一会话中两次prepare执行同一语句,并且之间有ps.close();

    useServerPrepStmts=false时,服务器会两次硬解析同一SQL

    useServerPrepStmts=true, cachePrepStmts=false时服务器仍然会两次硬解析同一SQL

    useServerPrepStmts=true, cachePrepStmts=true时服务器只会硬解析一次SQL

 

    如果两次prepare之间没有ps.close();那么cachePrepStmts=truecachePrepStmts=false也只需一次硬解析. 

    因此,客户端对同一sql,频繁分配和释放PreparedStatement对象的情况下,开启cachePrepStmts参数是很有必要的。

测试

   1)做了一个简单的测试,主要测试prepare的效果和useServerPrepStmts参数的影响.

 

1
<span style= "font-family: 宋体, SimSun; font-size: 14px;" >        cnt = 5000;<br>        // no prepare <br>        String sql =  "select biz_order_id,out_order_id,seller_nick,buyer_nick,seller_id,buyer_id,auction_id,auction_title,auction_price,buy_amount,biz_type,sub_biz_type,fail_reason,pay_status,logistics_status,out_trade_status,snap_path,gmt_create,status,ifnull(buyer_rate_status, 4) buyer_rate_status from tc_biz_order_0030 where "  +<br>         "parent_id = 594314511722841 or parent_id =547667559932641;" ;<br><br>         begin  = new  Date ();<br>        System. out .println( "begin:"  + df.format( begin ));<br>        <br>        stmt = con.createStatement();<br>         for  ( int  i = 0; i < cnt; i++)<br>        {         <br>            stmt.executeQuery(sql);<br>        } <br>               <br>         end  = new  Date ();<br>        System. out .println( "end:"  + df.format( end ));<br>        <br>        long  temp  end .getTime() -  begin .getTime();<br>        System. out .println( "no perpare interval:"  temp );<br>        <br>        <br>        // test  prepare        <br>        sql =  "select biz_order_id,out_order_id,seller_nick,buyer_nick,seller_id,buyer_id,auction_id,auction_title,auction_price,buy_amount,biz_type,sub_biz_type,fail_reason,pay_status,logistics_status,out_trade_status,snap_path,gmt_create,status,ifnull(buyer_rate_status, 4) buyer_rate_status from tc_biz_order_0030 where "  +<br>                 "parent_id = 594314511722841 or parent_id =?;" ;<br>        ps = con.prepareStatement(sql);<br>        BigInteger param = new BigInteger( "547667559932641" );<br>        <br>         begin  = new  Date ();<br>        System. out .println( "begin:"  + df.format( begin ));<br>        <br>         for  ( int  i = 0; i < cnt; i++)<br>        {<br>         ps.setObject(1, param);<br>            ps.executeQuery(); <br>        } <br>   <br>         end  = new  Date ();<br>        System. out .println( "end:"  + df.format( end ));<br>        <br>         temp  end .getTime() -  begin .getTime();<br>        System. out .println( "prepare interval:"  temp );<br></span>


经多次采样测试结果如下:


非prepare和prepare时间比
useServerPrepStmts=true 0.93
useServerPrepStmts=false 1.01


结论:

useServerPrepStmts=true时,prepare提升7%;

useServerPrepStmts=false时,prepare与非prepare性能相当。 


如果将语句简化为select * from tc_biz_order_0030 where parent_id =?。那么测试的结论useServerPrepStmts=true时,prepare仅提升2%;sql越简单硬解析的时间就越少,prepare的提升就越少。


注意:这个测试是在单个连接,单条sql的理想情况下进行的,线上会出现多连接多sql,还有sql执行频率,sql的复杂程度等不同,因此prepare的提升效果会随具体环境而变化。


2)prepare 前后的perf top 对比


   以下为非prepare

     6.46%   mysqld  mysqld              [.] _Z10MYSQLparsePv

     3.74%   mysqld  libc-2.12.so        [.] __memcpy_ssse3

     2.50%   mysqld  mysqld              [.] my_hash_sort_utf8

     2.15%   mysqld  mysqld              [.] cmp_dtuple_rec_with_match

     2.05%   mysqld  mysqld              [.] _ZL13lex_one_tokenPvS_

     1.46%   mysqld  mysqld              [.] buf_page_get_gen

     1.34%   mysqld  mysqld              [.] page_cur_search_with_match

     1.31%   mysqld  mysqld              [.] _ZL14build_templateP19row_prebuilt_structP3THDP5TABLEj

     1.24%   mysqld  mysqld              [.] rec_init_offsets

     1.11%   mysqld  libjemalloc.so.1    [.] free

     1.09%   mysqld  mysqld              [.] rec_get_offsets_func

     1.01%   mysqld  libjemalloc.so.1    [.] malloc

     0.96%   mysqld  libc-2.12.so        [.] __strlen_sse42

     0.93%   mysqld  mysqld              [.] _ZN4JOIN8optimizeEv

     0.91%   mysqld  mysqld              [.] _ZL15get_hash_symbolPKcjb

     0.88%   mysqld  mysqld              [.] row_search_for_mysql

     0.86%   mysqld  [kernel.kallsyms]   [k] tcp_recvmsg

     

 以下为perpare

     3.46%   mysqld  libc-2.12.so        [.] __memcpy_ssse3

     2.32%   mysqld  mysqld              [.] cmp_dtuple_rec_with_match

     2.14%   mysqld  mysqld              [.] _ZL14build_templateP19row_prebuilt_structP3THDP5TABLEj

     1.96%   mysqld  mysqld              [.] buf_page_get_gen

     1.66%   mysqld  mysqld              [.] page_cur_search_with_match

     1.54%   mysqld  mysqld              [.] row_search_for_mysql

     1.44%   mysqld  mysqld              [.] btr_cur_search_to_nth_level

     1.41%   mysqld  libjemalloc.so.1    [.] free

     1.35%   mysqld  mysqld              [.] rec_init_offsets

     1.32%   mysqld  [kernel.kallsyms]   [k] kfree

     1.14%   mysqld  libjemalloc.so.1    [.] malloc

     1.08%   mysqld  [kernel.kallsyms]   [k] fget_light

     1.05%   mysqld  mysqld              [.] rec_get_offsets_func

     0.99%   mysqld  mysqld              [.] _ZN8Protocol24send_result_set_metadataEP4ListI4ItemEj

     0.90%   mysqld  mysqld              [.] sync_array_print_long_waits

     0.87%   mysqld  mysqld              [.] page_rec_get_n_recs_before

     0.81%   mysqld  mysqld              [.] _ZN4JOIN8optimizeEv

     0.81%   mysqld  libc-2.12.so        [.] __strlen_sse42

     0.78%   mysqld  mysqld              [.] _ZL20make_join_statisticsP4JOINP10TABLE_LISTP4ItemP16st_dynamic_array

     0.72%   mysqld  [kernel.kallsyms]   [k] tcp_recvmsg

     0.63%   mysqld  libpthread-2.12.so  [.] __pthread_getspecific_internal

     0.63%   mysqld  [kernel.kallsyms]   [k] sk_run_filter

     0.60%   mysqld  mysqld              [.] _Z19find_field_in_tableP3THDP5TABLEPKcjbPj

     0.60%   mysqld  mysqld              [.] page_check_dir

     0.57%   mysqld  mysqld              [.] _Z16dispatch_command19enum_server_commandP3THDP

   对比可以发现 MYSQLparse lex_one_token在prepare时已优化掉了。

思考

   1 开启cachePrepStmts的问题,前面谈到每个连接都有一个缓存,是以sql为唯一标识的LRU cache. 在分表较多,大连接的情况下,可能会个应用服务器带来内存问题。这里有个前提是ibatis是默认使用prepare的。 mybatis中,标签statementType可以指定某个sql是否是使用prepare.

statementType Any one of STATEMENT, PREPARED or CALLABLE. This causes MyBatis to use Statement, PreparedStatement orCallableStatement respectively. Default: PREPARED.

这样可以精确控制只对频率较高的sql使用prepare,从而控制使用prepare sql的个数,减少内存消耗。遗憾的是目前集团貌似大多使用的是ibatis 2.0版本,不支持statementType

标签。

    服务器端prepare cache是一个HASH MAP. Keystmt->id,同时也是每个连接都维护一个。因此也有可能出现内存问题,待实际测试。如有必要需改造成Keysql的全局cache,这样不同连接的相同prepare sql可以共享。 

    3 oracle prepare与mysql prepare的区别:

      mysql与oracle有一个重大区别是mysql没有oracle那样的执行计划缓存。前面我们讲到SQL执行过程包括以下阶段 词法分析->语法分析->语义分析->执行计划优化->执行。oracle的prepare实际上包括以下阶段:词法分析->语法分析->语义分析->执行计划优化,也就是说oracle的prepare做了更多的事情,execute只需要执行即可。因此,oracle的prepare比mysql更高效。


相关实践学习
如何快速连接云数据库RDS MySQL
本场景介绍如何通过阿里云数据管理服务DMS快速连接云数据库RDS MySQL,然后进行数据表的CRUD操作。
全面了解阿里云能为你做什么
阿里云在全球各地部署高效节能的绿色数据中心,利用清洁计算为万物互联的新世界提供源源不断的能源动力,目前开服的区域包括中国(华北、华东、华南、香港)、新加坡、美国(美东、美西)、欧洲、中东、澳大利亚、日本。目前阿里云的产品涵盖弹性计算、数据库、存储与CDN、分析与搜索、云通信、网络、管理与监控、应用服务、互联网中间件、移动服务、视频服务等。通过本课程,来了解阿里云能够为你的业务带来哪些帮助 &nbsp; &nbsp; 相关的阿里云产品:云服务器ECS 云服务器 ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,助您降低 IT 成本,提升运维效率,使您更专注于核心业务创新。产品详情: https://www.aliyun.com/product/ecs
目录
打赏
0
0
0
0
9167
分享
相关文章
MySQL原理简介—6.简单的生产优化案例
本文介绍了数据库和存储系统的几个主题: 1. **MySQL日志的顺序写和数据文件的随机读指标**:解释了磁盘随机读和顺序写的原理及对数据库性能的影响。 2. **Linux存储系统软件层原理及IO调度优化原理**:解析了Linux存储系统的分层架构,包括VFS、Page Cache、IO调度等,并推荐使用deadline算法优化IO调度。 3. **数据库服务器使用的RAID存储架构**:介绍了RAID技术的基本概念及其如何通过多磁盘阵列提高存储容量和数据冗余性。 4. **数据库Too many connections故障定位**:分析了MySQL连接数限制问题的原因及解决方法。
MySQL原理简介—3.生产环境的部署压测
本文介绍了Java系统和数据库在高并发场景下的压测要点: 1. 普通系统在4核8G机器上每秒能处理几百个请求 2. 高并发下数据库建议使用8核16G或更高配置的机器 3. 数据库部署后需进行基准压测,以评估其最大承载能力 4. QPS和TPS的区别及重要性 5. 压测时需关注IOPS、吞吐量、延迟 6. 除了QPS和TPS,还需监控CPU、内存、磁盘IO、网络带宽 7. 影响每秒可处理并发请求数的因素包括线程数、CPU、内存、磁盘IO和网络带宽 8. Sysbench是数据库压测工具,可构造测试数据并模拟高并发场景 9. 在增加线程数量的同时,必须观察机器的性能,确保各硬件负载在合理范围
123 72
MySQL原理简介—1.SQL的执行流程
本文介绍了MySQL驱动、数据库连接池及SQL执行流程的关键组件和作用。主要内容包括:MySQL驱动用于建立Java系统与数据库的网络连接;数据库连接池提高多线程并发访问效率;MySQL中的连接池维护多个数据库连接并进行权限验证;网络连接由线程处理,监听请求并读取数据;SQL接口负责执行SQL语句;查询解析器将SQL语句解析为可执行逻辑;查询优化器选择最优查询路径;存储引擎接口负责实际的数据操作;执行器根据优化后的执行计划调用存储引擎接口完成SQL语句的执行。整个流程确保了高效、安全地处理SQL请求。
171 76
RDS用多了,你还知道MySQL主从复制底层原理和实现方案吗?
随着数据量增长和业务扩展,单个数据库难以满足需求,需调整为集群模式以实现负载均衡和读写分离。MySQL主从复制是常见的高可用架构,通过binlog日志同步数据,确保主从数据一致性。本文详细介绍MySQL主从复制原理及配置步骤,包括一主二从集群的搭建过程,帮助读者实现稳定可靠的数据库高可用架构。
39 9
RDS用多了,你还知道MySQL主从复制底层原理和实现方案吗?
MySQL原理简介—9.MySQL索引原理
本文详细介绍了MySQL索引的设计与使用原则,涵盖磁盘数据页的存储结构、页分裂机制、主键索引设计及查询过程、聚簇索引和二级索引的原理、B+树索引的维护、联合索引的使用规则、SQL排序和分组时如何利用索引、回表查询对性能的影响以及索引覆盖的概念。此外还讨论了索引设计的案例,包括如何处理where筛选和order by排序之间的冲突、低基数字段的处理方式、范围查询字段的位置安排,以及通过辅助索引来优化特定查询场景。总结了设计索引的原则,如尽量包含where、order by、group by中的字段,选择离散度高的字段作为索引,限制索引数量,并针对频繁查询的低基数字段进行特殊处理等。
MySQL原理简介—9.MySQL索引原理
MySQL底层概述—6.索引原理
本文详细回顾了:索引原理、二叉查找树、平衡二叉树(AVL树)、红黑树、B-Tree、B+Tree、Hash索引、聚簇索引与非聚簇索引。
MySQL底层概述—6.索引原理
MySQL原理简介—12.MySQL主从同步
本文介绍了四种为MySQL搭建主从复制架构的方法:异步复制、半同步复制、GTID复制和并行复制。异步复制通过配置主库和从库实现简单的主从架构,但存在数据丢失风险;半同步复制确保日志复制到从库后再提交事务,提高了数据安全性;GTID复制简化了配置过程,增强了复制的可靠性和管理性;并行复制通过多线程技术降低主从同步延迟,保证数据一致性。此外,还讨论了如何使用工具监控主从延迟及应对策略,如强制读主库以确保即时读取最新数据。
MySQL原理简介—12.MySQL主从同步
MySQL实现文档全文搜索,分词匹配多段落重排展示,知识库搜索原理分享
本文介绍了在文档管理系统中实现高效全文搜索的方案。为解决原有ES搜索引擎私有化部署复杂、运维成本高的问题,我们转而使用MySQL实现搜索功能。通过对用户输入预处理、数据库模糊匹配、结果分段与关键字标红等步骤,实现了精准且高效的搜索效果。目前方案适用于中小企业,未来将根据需求优化并可能重新引入专业搜索引擎以提升性能。
MySQL原理简介—7.redo日志的底层原理
本文介绍了MySQL中redo日志和undo日志的主要内容: 1. redo日志的意义:确保事务提交后数据不丢失,通过记录修改操作并在系统宕机后重做日志恢复数据。 2. redo日志文件构成:记录表空间号、数据页号、偏移量及修改内容。 3. redo日志写入机制:redo日志先写入Redo Log Buffer,再批量刷入磁盘文件,减少随机写以提高性能。 4. Redo Log Buffer解析:描述Redo Log Buffer的内存结构及刷盘时机,如事务提交、Buffer过半或后台线程定时刷新。 5. undo日志原理:用于事务回滚,记录插入、删除和更新前的数据状态,确保事务可完整回滚。
101 22
MySQL原理简介—8.MySQL并发事务处理
这段内容深入探讨了SQL语句执行原理、事务并发问题、MySQL事务隔离级别及其实现机制、锁机制以及数据库性能优化等多个方面。

相关产品

  • 云数据库 RDS MySQL 版
  • AI助理

    你好,我是AI助理

    可以解答问题、推荐解决方案等