当前位置：移动技术网 > IT编程>数据库>Oracle > Oracle Index 的三个问题

Oracle Index 的三个问题

2017年12月12日 | 移动技术网IT编程 | 我要评论

正在看的oracle教程是:oracle index 的三个问题。

　索引( index )是常见的数据库对象，它的设置好坏、使用是否得当，极大地影响数据库应用程序和database 的性能。虽然有许多资料讲索引的用法， dba 和 developer 们也经常与它打交道，但笔者发现，还是有不少的人对它存在误解，因此针对使用中的常见问题，讲三个问题。此文所有示例所用的数据库是 oracle 8.1.7 ops on hp n series ,示例全部是真实数据，读者不需要注意具体的数据大小，而应注意在使用不同的方法后，数据的比较。本文所讲基本都是陈词滥调，但是笔者试图通过实际的例子，来真正让您明白事情的关键。

　　第一讲、索引并非总是最佳选择

　　如果发现oracle 在有索引的情况下，没有使用索引，这并不是oracle 的优化器出错。在有些情况下，oracle 确实会选择全表扫描（full table scan）,而非索引扫描（index scan）。这些情况通常有：

　　1. 表未做statistics, 或者 statistics 陈旧，导致 oracle 判断失误。

　　2. 根据该表拥有的记录数和数据块数，实际上全表扫描要比索引扫描更快。

　　对第1种情况，最常见的例子，是以下这句sql 语句：

　　在未作statistics 之前，它使用全表扫描，需要读取6000多个数据块（一个数据块是8k）, 做了statistics 之后，使用的是 index (fast full scan) ，只需要读取450个数据块。但是，statistics 做得不好，也会导致oracle 不使用索引。

　　第2种情况就要复杂得多。一般概念上都认为索引比表快，比较难以理解什么情况下全表扫描要比索引扫描快。为了讲清楚这个问题，这里先介绍一下oracle 在评估使用索引的代价（cost）时两个重要的数据：cf(clustering factor) 和 ff(filtering factor).

　　cf: 所谓 cf, 通俗地讲，就是每读入一个索引块，要对应读入多少个数据块。

　　ff: 所谓 ff, 就是该sql 语句所选择的结果集，占总的数据量的百分比。

　　大约的计算公式是：ff * (cf + 索引块个数) ，由此估计出，一个查询，如果使用某个索引，会需要读入的数据块块数。需要读入的数据块越多，则 cost 越大，oracle 也就越可能不选择使用 index. （全表扫描需要读入的数据块数等于该表的实际数据块数）

　　其核心就是， cf 可能会比实际的数据块数量大。cf 受到索引中数据的排列方式影响，通常在索引刚建立时，索引中的记录与表中的记录有良好的对应关系，cf 都很小；在表经过大量的插入、修改后，这种对应关系越来越乱，cf 也越来越大。此时需要 dba 重新建立或者组织该索引。

　　如果某个sql 语句以前一直使用某索引，较长时间后不再使用，一种可能就是 cf 已经变得太大，需要重新整理该索引了。

　　ff 则是oracle 根据 statistics 所做的估计。比如, mytables 表有32万行，其主键myid的最小值是1，最大值是409654，考虑以下sql 语句：

　　这两句看似差不多的 sql 语句，对oracle 而言，却有巨大的差别。因为前者的 ff 是100%，而后者的 ff 可能只有 1%。如果它的cf 大于实际的数据块数，则oracle 可能会选择完全不同的优化方式。而实际上，在我们的数据库上的测试验证了我们的预测. 以下是在hp 上执行时它们的 explain plan:

　　第一句：

　　已选择325917行。

　　第二句：

　　显而易见，第1句没有使用索引，第2句使用了主键索引pk_mytables. ff的巨大影响由此可见一斑。由此想到，我们在写sql 语句时，如果预先估计一下 ff, 你就几乎可以预见到 oracle 会否使用索引。

[nextpage]

第二讲、索引也有好坏

　　索引有 b tree 索引， bitmap 索引， reverse b tree 索引，等。最常用的是 b tree 索引。 b 的全称是balanced , 其意义是，从 tree 的 root 到任何一个leaf ，要经过同样多的 level. 索引可以只有一个字段（single column）, 也可以有多个字段（composite）,最多32个字段，8i 还支持 function-based index. 许多developer 都倾向于使用单列b 树索引。

　　所谓索引的好坏是指：

　　1，索引不是越多越好。特别是大量从来或者几乎不用的索引，对系统只有损害。oltp系统每表超过5个索引即会降低性能，而且在一个sql 中， oracle 从不能使用超过 5个索引。

　　2，很多时候，单列索引不如复合索引有效率。

　　3，用于多表连结的字段，加上索引会很有作用。

　　那么，在什么情况下单列索引不如复合索引有效率呢？有一种情况是显而易见的，那就是，当sql 语句所查询的列，全部都出现在复合索引中时，此时由于 oracle 只需要查询索引块即可获得所有数据，当然比使用多个单列索引要快得多。（此时，这种优化方式被称为 index only access path）

　　除此之外呢？我们还是来看一个例子吧：

　　在 hp（oracle 8.1.7）上执行以下语句：

　　一开始，我们有两个单列索引：i_mytabs1(coid), i_mytabs2(issuedate), 下面是执行情况：

　　可以看到，它读取了7000个数据块来获得所查询的 6000多行。

　　现在，去掉这两个单列索引，增加一个复合索引i_mytabs_test ( coid, issuedate), 重新执行，结果如下：

　　可以看到，这次只读取了300个数据块。

　　7000块对300块，这就是在这个例子中，单列索引与复合索引的代价之比。这个例子提示我们，在许多情况下，单列索引不如复合索引有效率。

　　可以说，在索引的设置问题上，其实有许多工作可以做。正确地设置索引，需要对应用进行总体的分析。
1 3

[nextpage]

第三讲、索引再好，不用也是白搭

　　抛开前面所说的，假

[1] [2] 下一页

正在看的oracle教程是:oracle index 的三个问题。设你设置了一个非常好的索引，任何傻瓜都知道应该使用它，但是oracle 却偏偏不用，那么，需要做的第一件事情，是审视你的 sql 语句。

　　oracle 要使用一个索引，有一些最基本的条件：

　　1， where 子句中的这个字段，必须是复合索引的第一个字段；

　　2， where 子句中的这个字段，不应该参与任何形式的计算

　　具体来讲，假设一个索引是按 f1, f2, f3的次序建立的，现在有一个 sql 语句, where 子句是 f2 = : var2, 则因为 f2 不是索引的第1个字段，无法使用该索引。

　　第2个问题，则在我们之中非常严重。以下是从实际系统上面抓到的几个例子：

　　以上的例子能很容易地进行改进。请注意这样的语句每天都在我们的系统中运行，消耗我们有限的cpu 和内存资源。

　　除了1，2这两个我们必须牢记于心的原则外，还应尽量熟悉各种操作符对 oracle 是否使用索引的影响。这里我只讲哪些操作或者操作符会显式（explicitly）地阻止 oracle 使用索引。以下是一些基本规则：

　　1，如果 f1 和 f2 是同一个表的两个字段，则 f1>f2, f1>=f2, f1

　　2， f1 is null, f1 is not null, f1 not in, f1 !=, f1 like ‘%pattern%';

　　3， not exist

　　4，某些情况下，f1 in 也会不用索引；

　　对于这些操作，别无办法，只有尽量避免。比如，如果发现你的 sql 中的 in 操作没有使用索引，也许可以将 in 操作改成比较操作 + union all。笔者在实践中发现很多时候这很有效。

　　但是，oracle 是否真正使用索引，使用索引是否真正有效，还是必须进行实地的测验。合理的做法是，对所写的复杂的 sql, 在将它写入应用程序之前，先在产品数据库上做一次explain . explain 会获得oracle 对该 sql 的解析（plan）,可以明确地看到 oracle 是如何优化该 sql 的。

　　如果经常做 explain, 就会发现，喜爱写复杂的 sql 并不是个好习惯，因为过分复杂的sql 其解析计划往往不尽如人意。事实上，将复杂的 sql 拆开，有时候会极大地提高效率，因为能获得很好的优化。当然这已经是题外话了。

上一页

上一页 [1] [2]

您可能感兴趣的文章:

如对本文有疑问，点击进行留言回复！！

oracle数据库相关练习一(基础、单行函数、组函数)

1.查询员工表所有数据select * from employees;2.打印公司里所有的manager_ids... [阅读全文]
Oracle查询用户，表结构，表索引，存储过程，触发器等信息整理

1.查询当前登录用户的表select * from user_tables；2.查询scott用户所有表sele... [阅读全文]
oracle的自连接、内连接、外连接、交叉连接、自然连接、等值连接、不等值连接

等值连接：关联条件要写表名.字段名=表名.字段名等值连接中可能有笛卡尔积运算自然连接 natural jo... [阅读全文]
hibernate多对多关联关系

文章目录多对多概念hibernate的多对多多对多关系注意事项代码案例多对多概念首先我们来说一下多对多的概念，可... [阅读全文]
数据库从0到0

数据库前言问题一：为什么要分数据类型？前言写个博客来记录我的一生问题一：为什么要分数据类型？刚刚入门的时候其实很... [阅读全文]
Oracle数据库使用replace函数批量删除数据中的双引号

有这么一个数据库表现在我想把name字段里的双引号去掉，如果数据量大时，不可能一个一个删，咋办？可以先使用sel... [阅读全文]
手撕自动驾驶（一）自动驾驶初探

以下都是我的个人理解，说的不对的欢迎狂怼。借用apollo的架构说事：自动驾驶由这7部分组成：1.感知。就... [阅读全文]
自定义Swing的JList组件中的显示内容

本人在做项目时，想要在JList的每一项中都显示一个进度条，搜索了很多文章和论坛，都没有查到所需的资料。遂查阅O... [阅读全文]
Oracle RAC简介与要点

RAC的作用RAC可以提供实例级别的冗余，避免单实例数据库实例一旦出现故障会影响下游业务系统的问题，提供多个（n... [阅读全文]
Oracle中分组查询group by用法规则详解

oracle中group by用法在select 语句中可以使用group by 子句将行划分成较小的组，一旦使用分组后select操作的对象变为各个分组后的数... [阅读全文]

网友评论


验证码：

Oracle Index 的三个问题

2017年12月12日 | 移动技术网IT编程 | 我要评论

您可能感兴趣的文章:

相关文章:

网友评论