GIN 索引代替 bitmap 索引

简介: 使用GIN代替bitmap索引, 减少索引空间开销

在一些数据库系统中, bitmap 索引经常用来给一些具有大量重复值的字段建立索引。 布尔字段(性别)、状态编码等。
相比于使用正常的 B-Tree 索引, Bitmap 显示的非常高效。

PostgreSQL 并不支持bitmap索引, 但是使用GIN索引可以非常好的处理这种冗余度高的字段。GIN 索引的内部结构与bitmap
是非常相似的。它并不是使用bitmap作为索引项,但是在9.4版本中,它使用的是 varbyte 编码,在最好的情况下, 每一个索引
项只需要占用一个字节。之前是使用 2-3个字节用来存放索引项。在早期的版本,是使用6个字节来存放索引条目,但是这相比于
B-Tree 每个索引条目仍然具有非常小的开销。

创建一个表, 并使用一些字段用来填充它。


CREATE TABLE numbers (n int4, mod2 int4);

insert into numbers (n, mod2) select n, n%2 from generate_series(1, 10000000) n;

这里用到了扩展件 btree_gin, 下面为表创建 GIN 索引


create extension btree_gin;

create index numbers_mod2_gin_idx on numbers using gin(mod2);

对比实验, 我们为相同的列创建B-Tree 索引


create index numbers_mod2_btree_idx on numbers using btree (mod2);

检查建立的索引

di+

public | numbers_mod2_btree_idx | index | whatcat | numbers | 214 MB |
public | numbers_mod2_gin_idx | index | whatcat | numbers | 10 MB |


在这里我们可以看到, GIN 索引相比于 B-Tree 索引有20倍小。
目录
相关文章
|
6月前
|
SQL 搜索推荐 关系型数据库
|
6月前
|
SQL 关系型数据库 MySQL
关于索引的使用
关于索引的使用
|
关系型数据库 MySQL 数据库
了解和认识索引
了解和认识索引。
52 0
|
数据库 索引
请注意这些情况下,你的索引会不生效!
数据库性能优化是确保系统高效运行的关键要素之一。而索引作为提升数据库查询性能的重要工具,在大部分情况下都能发挥显著的作用。然而,在某些情况下,索引可能会失效或不起作用,导致查询性能下降,甚至引发性能瓶颈。
|
算法 关系型数据库 MySQL
MySQL - 索引方法 BTree 索引和 Hash 索引的区别
MySQL - 索引方法 BTree 索引和 Hash 索引的区别
157 0
|
SQL 关系型数据库 数据库
PostgreSQL 设计优化case - 大宽表任意字段组合查询索引如何选择(btree, gin, rum) - (含单个索引列数超过32列的方法)
标签 PostgreSQL , adhoc查询 , 大宽表 , 任意字段组合查询 , 索引 , btree , gin , rum 背景 大宽表,任意字段组合查询,透视。是实时分析系统中的常见需求: 1、实时写入。
2676 0