Oracle hash join

Alibaba DBA Team 2010-11-28 18:56:00 累计浏览 4,241 次

本机暂存

内容概览

这篇讲的是Oracle中hash join的运作原理，它被作者称为一个“非常强悍的功能”。文章没有停留在理论，而是直白地剖析了其核心流程：Oracle首先会选择一个表作为驱动表，根据过滤条件进行筛选，然后将结果集构建成一个哈希表存放在进程的PGA内存（hash area）中。接着，它再去扫描第二张表，对每一行的键值进行哈希运算，并到内存的哈希表中去“探测”，命中则返回数据，否则丢弃。

但文章的重点不止于此。作者紧接着点出了关键现实约束：考虑到单个进程PGA内存的大小，Oracle并不会允许无限制地消耗系统内存。因此，这个看似直接的过程在Oracle内部实际上被细化为三种不同的执行模式。这恰恰解释了在不同数据规模或内存条件下，查询计划为什么会发生差异。

文章从原理讲到内存限制的现实考量，为读者勾勒出一个更立体的hash join图景，其细节对于理解数据库性能和配置背后的逻辑很有启发。

hash join是oracle里面一个非常强悍的功能，当做hash join时，oracle会选择一个表作为驱动表，先根据过滤条件排除不必要的数据，然后将结果集做成hash表，放入进程的hash area，接着扫描第二张表，将行的键值做hash运算，到内存的hash表里面去探测，如果探测成功，就返回数据，否则这行就丢弃掉这个是最基本的解释，实际情况中，考虑到单个进程PGA的大小，oracle不会让进程任意的消耗OS内存，hash area是有一定限制的，所以在oracle中，hash也有三种模式：

optimal，onepass，multipass

optimal:当驱动结果集生成的hash表全部可以放入PGA的hash area时，称为optimal，大致过程如下：

1.先根据驱动表，得到驱动结果集

2.在hash area生成hash bulket，并将若干bulket分成一组，成为一个partition，还会生成一个bitmap的列表，每个bulket在上面占一位

3.对结果集的join键做hash运算，将数据分散到相应partition的bulket中，当运算完成后，如果键值唯一性较高的话，bulket里的数据会比较均匀，也有可能有的桶里面数据会是空的，这样bitmap上对应的标志位就是0，有数据的桶，标志位会是1

4.开始扫描第二张表，对jion键做hash运算，确定应该到某个partition的某个bulket去探测，探测之前，会看这个bulket的bitmap是否会1，如果为0，表示没数据，这行就直接丢弃掉

5.如果bitmap为1，则在桶内做精确匹配，判断OK后，返回数据

这个是最优的hash join，他的成本基本是两张表的full table scan，在加微量的hash运算

onepass

如果进程的pga很小，或者驱动表结果集很大，超过了hash area的大小，会怎么办？当然会用到临时表空间，此时oracle的处理方式稍微复杂点需奥注意上面提到的有个partition的概念，可以这么理解，数据是经过两次hash运算的，先确定你的partition，再确定你的bulket，假设hash area小于整个hash table，但至少大于一个partition的size，这个时候走的就是onepass

当我们生成好hash表后，状况是部分partition留在内存中，其他的partition留在磁盘临时表空间中，当然也有可能某个partition一半在内存，一半在磁盘，剩下的步骤大致如下：

1.扫描第二张表，对join键做hash运算，确定好对应的partition和bulket

2.查看bitmap，确定bulket是否有数据，没有则直接丢弃

3.如果有数据，并且这个partition是在内存中的，就进入对应的桶去精确匹配，能匹配上，就返回这行数据，否则丢弃

4.如果partition是在磁盘上的，则将这行数据放入磁盘中暂存起来，保存的形式也是partition，bulket的方式

5.当第二张表被扫描完后，剩下的是驱动表和探测表生成的一大堆partition，保留在磁盘上

6.由于两边的数据都按照相同的hash算法做了partition和bulket，现在只要成对的比较两边partition数据即可，并且在比较的时候，oracle也做了优化处理，没有严格的驱动与被驱动关系，他会在partition对中选较小的一个作为驱动来进行，直到磁盘上所有的partition对都join完

可以发现，相比optimal，他多出的成本是对于无法放入内存的partition，重新读取了一次，所以称为onepass，只要你的内存保证能装下一个partition，oracle都会腾挪空间，每个磁盘partition做到onepass

multipass

这是最复杂，最糟糕的hash join，此时hash area小到连一个partition也容纳不下，当扫描好驱动表后，可能只有半个partition留在hash area中，另半个加其他的partition全在磁盘上,剩下的步骤和onepass比价类似，不同的是针对partition的处理

由于驱动表只有半个partition在内存中，探测表对应的partition数据做探测时，如果匹配不上，这行还不能直接丢弃，需要继续保留到磁盘，和驱动表剩下的半个partition再做join，这里举例的是内存可以装下半个partition，如果装的更少的话，反复join的次数将更多，当发生multipass时，partition物理读的次数会显著增加。

同分类推荐文章

使用deepseek进行Oracle恢复,引起重大故障（2026-06-22 10:56:00）
接手一个只差临门一脚的数据库恢复（2026-06-18 00:13:09）
我做了一个 AI 版的 StarRocks 升级风险扫描工具，直接帮我定位到一个风险（2026-06-15 01:00:00）

查看更多数据库文章 →

建议继续学习

Oracle MTS模式下进程地址与会话信息（累计阅读 14,409）
那些在11gR2中可能惹祸的新特性，一张列表帮助你摆脱升级11gR2带来的烦恼（累计阅读 6,880）
性能测试工具sysbench简介（累计阅读 6,027）
大于2GB的Listener.log和运行超过198天的主机上的Oracle实例（累计阅读 5,863）
仅仅只备份是不够的（累计阅读 5,825）
Oracle Database 12c 新特性 - Native Top N 查询（累计阅读 5,751）
ORACLE最大可以存储多少数据量（累计阅读 5,730）
Oracle DBA的学习进阶成长树-从初出茅庐到高瞻远瞩（累计阅读 5,603）
老托的Oracle 数据库Patch概念性小常识（累计阅读 5,550）
查看oracle数据库用户下的所有空表（累计阅读 5,505）