SqlServer 索引自动优化工具-mysql教程-PHP中文网

首页

数据库

mysql教程

SqlServer 索引自动优化工具

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jun 07, 2016 pm 06:07 PM

索引自动优化

前段接手了个优化项目，大概要求是对公司现有的1W多张表进行索引优化，完善现有的，剔除无效的索引

鉴于人手严重不足（当时算两个半人的资源），打消了逐个库手动去改的念头。当前的程序结构不允许搞革命的做法，只能搞搞改良，所以准备搞个自动化工具去处理。原型刚开发完，开会的时候以拿出来就遭到运维DBA团队强烈抵制，具体原因不详。最后无限延期。这里把思路分享下。欢迎拍砖。

　　整个思路是这样的，索引都是为查询和更新服务的，但是不合适的索引又会对插入和更新带来负面影响。面对表上现有的索引想识别那些是有效的不太可能。那么根据现有的数据使用情况重建所有的新索引不就解决了嘛。根据查询生成全新索引，然后和现有对比，不吻合的全部删除，原来没有的创建。虽然说对于正在运行的系统来说风险还是蛮大的。但是可以做临界测试嘛。
　　
具体解决方案如下：

　　首先在热备的数据库服务器上定期抓取缓存的执行计划（原本想抓取SQL发现有些SQL实在掺不忍睹，没有自动化解析的可能性），然后连同该执行的执行次数即表的统计信息一起down到一个备用服务器的数据表中。

　　执行计划积累几次后，开始解析。由于执行计划是格式良好的XML文件，加上微软提供执行计划的XSD文件。我们可以反向推出各节点对应的SQL谓词（这个XSD到现在都没找到官方的说明，只能反向推出关联）。例如建立索引我们比较关心三类谓词，分别为：Select，Join，Where。只要拿到这些我们就能建立良好的索引。原理很简单，Join和Where都是索引键的依据，而Select可以斟请添加到Index的Include中。
　　
　　解析的时候也不是针对单个执行计划，而是将所有执行计划全分解后进行统计处理。好处就是能够知道那些表字段被引用的最多，那些是外键列。那些数据被反复查询。例如可以得出TableA的Col1列在一天的业务过程中被Join了10W次，被Where2W次。而Col2则被Select了10W次，仅仅被Where了100次。这样我们建立索引的基础就是基于表的而不是基于单个查询的。最终生成的Index将权衡查询频率和查询的重要性，如果某个业务查询特别重要，但执行频率不高我们可以提供权重，优先建立索引。当然创建Index还要参考表的数据分布以决定Index中字段的顺序。

　　好了，准备工作完成，开始建索引。当前拥有的条件，表数据分布，表字段分别被查询引用次数（Select，Join，Where），以及这些SQL谓词出现的次数。根据这些如何创建索引开始的想法是逐个分析，考虑所有可能性然后创建。发现这种方式只适合人脑，让电脑做得先让电脑的智商增长到120以上才有可行性。发现逆向思维这里同样大有用处，既然不能一下子创建最合适的，那我们就根据执行计划得出的组合创建所有的Index组合。凡是Join和Where都放到Index的Key里。例如：
　　select t1.A, t1.B, t1.C, t2.J, t2.k from Table1 t1 Join Table1 t2 on t1.A = t2.j Where t1.A = 'param'

草创的索引就是：

　　Index（A，B）includ(C) 和 Index（j）include（j,k）

关于Select如果是小数据类型且Alter的执行计划中该数据修改频率很小的都放到Include里去进去。大数据类型和修改比较频繁的就算了。这样我们剔除相互覆盖的。部分重叠的，部分重叠到底保留那一个参考执行频率和查询重要性。差异很小的就合并并为一个，如：

　　1.Index （A，B，C）Include（D）
　　2.Index（A，B，D）Include（C）

直接合并为：

　　Index（A，B）Include（C，D）

当然如果Alert的特别少也可以合并成Index（A，B，C，D）这个要参考C，D字段的修改频率。和主键重叠的剔除。这样留下的基本上就是我们需要的索引了。
　　
　　对比现有索引进行甄别覆盖的过程就略过。简单的拉出来Create　Index　进行解析处理就好了。发布的时候很简单。写个脚本在业务比较少的时候做Drop和Create就完成了。项目源代码因为设计到公司的保密问题就不上传了。一个注意的地方对于简单查询的SQL执行计划缓存的时候会比较短且一旦缓存不够就会被清理掉。要注意这些SQL的执行频率的误差。

　　SqlserverR2 XSD：
　
　总结的节点映射列举如下：

　　　　查询sql执行计划都包含在节点“StmtSimple”中，如果没有这个节点一般就是其它类型的SQL的执行计划。

　　　　Join关联的节点和自身类型有关一般包含在Hash，Marger中，如何Join同时又是Where条件的话则会出现在SeekKey和Compare节点中，因为Join的列都是成对出现，这里很容易识别，有一个是参数（@开头）或常量（type="Const"）则必定是Where条件。
　　　　
　　　　Select最终输出字段比较容易找到，第一个OutputList节点就是。

　　　　需要注意的是有因为一般列每个ColumnReference都包含库名，表名，列信息，但是系统表则不会。注意剔除。

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

MySQL：世界上最受欢迎的数据库的简介Apr 12, 2025 am 12:18 AM

MySQL是一种开源的关系型数据库管理系统，主要用于快速、可靠地存储和检索数据。其工作原理包括客户端请求、查询解析、执行查询和返回结果。使用示例包括创建表、插入和查询数据，以及高级功能如JOIN操作。常见错误涉及SQL语法、数据类型和权限问题，优化建议包括使用索引、优化查询和分表分区。

MySQL的重要性：数据存储和管理Apr 12, 2025 am 12:18 AM

MySQL是一个开源的关系型数据库管理系统，适用于数据存储、管理、查询和安全。1.它支持多种操作系统，广泛应用于Web应用等领域。2.通过客户端-服务器架构和不同存储引擎，MySQL高效处理数据。3.基本用法包括创建数据库和表，插入、查询和更新数据。4.高级用法涉及复杂查询和存储过程。5.常见错误可通过EXPLAIN语句调试。6.性能优化包括合理使用索引和优化查询语句。

为什么要使用mysql？利益和优势Apr 12, 2025 am 12:17 AM

选择MySQL的原因是其性能、可靠性、易用性和社区支持。1.MySQL提供高效的数据存储和检索功能，支持多种数据类型和高级查询操作。2.采用客户端-服务器架构和多种存储引擎，支持事务和查询优化。3.易于使用，支持多种操作系统和编程语言。4.拥有强大的社区支持，提供丰富的资源和解决方案。

描述InnoDB锁定机制（共享锁，独家锁，意向锁，记录锁，间隙锁，下一键锁）。Apr 12, 2025 am 12:16 AM

InnoDB的锁机制包括共享锁、排他锁、意向锁、记录锁、间隙锁和下一个键锁。1.共享锁允许事务读取数据而不阻止其他事务读取。2.排他锁阻止其他事务读取和修改数据。3.意向锁优化锁效率。4.记录锁锁定索引记录。5.间隙锁锁定索引记录间隙。6.下一个键锁是记录锁和间隙锁的组合，确保数据一致性。

MySQL查询性能差的常见原因是什么？Apr 12, 2025 am 12:11 AM

MySQL查询性能不佳的原因主要包括没有使用索引、查询优化器选择错误的执行计划、表设计不合理、数据量过大和锁竞争。 1.没有索引导致查询缓慢，添加索引后可显着提升性能。 2.使用EXPLAIN命令可以分析查询计划，找出优化器错误。 3.重构表结构和优化JOIN条件可改善表设计问题。 4.数据量大时，采用分区和分表策略。 5.高并发环境下，优化事务和锁策略可减少锁竞争。

您什么时候应该使用复合索引与多个单列索引？Apr 11, 2025 am 12:06 AM

在数据库优化中，应根据查询需求选择索引策略：1.当查询涉及多个列且条件顺序固定时，使用复合索引；2.当查询涉及多个列但条件顺序不固定时，使用多个单列索引。复合索引适用于优化多列查询，单列索引则适合单列查询。

如何识别和优化MySQL中的慢速查询？（慢查询日志，performance_schema）Apr 10, 2025 am 09:36 AM

要优化MySQL慢查询，需使用slowquerylog和performance_schema：1.启用slowquerylog并设置阈值，记录慢查询；2.利用performance_schema分析查询执行细节，找出性能瓶颈并优化。

MySQL和SQL：开发人员的基本技能Apr 10, 2025 am 09:30 AM

MySQL和SQL是开发者必备技能。1.MySQL是开源的关系型数据库管理系统，SQL是用于管理和操作数据库的标准语言。2.MySQL通过高效的数据存储和检索功能支持多种存储引擎，SQL通过简单语句完成复杂数据操作。3.使用示例包括基本查询和高级查询，如按条件过滤和排序。4.常见错误包括语法错误和性能问题，可通过检查SQL语句和使用EXPLAIN命令优化。5.性能优化技巧包括使用索引、避免全表扫描、优化JOIN操作和提升代码可读性。

See all articles