宾曰语云被法学教授投诉：严重侵权，“违法犯罪”！

二湘：朱令去世一周年，清华学子控诉清华在朱令案中的冷血和无耻

“上海王”柯庆施之死的真相

毕业论文辅导| 你又不是伞，硕士论文|毕业论文|博士论文|课题论文不行就被硬撑了,靠谱的辅导机构才是晴雨伞！

缺人：60r/次，立结~

"富人"的烦恼

Original digoal PostgreSQL码农集散地 2024-07-08

文中参考文档点击阅读原文打开, 同时推荐2个学习环境:

1、懒人Docker镜像, 已打包200+插件:《最好的PostgreSQL学习镜像》

2、有web浏览器就能用的云起实验室: 《免费体验PolarDB开源数据库》

3、PolarDB开源数据库内核、最佳实践等学习图谱: https://www.aliyun.com/database/openpolardb/activity

关注公众号, 持续发布PostgreSQL、PolarDB、DuckDB等相关文章.

第35期吐槽:"富人"的烦恼?PG 不会自动选择索引类型

1、产品的问题点

PG 不会自动选择索引类型

2、问题点背后涉及的技术原理

PG 支持很多种类的索引, hash, btree, gin, gist, sp-gist, brin, bloom, 还有外置的rum, pase, zombodb等.

每种索引的存储结构都不一样, 可以加速的场景也不一样
参考我github的文档: 《PostgreSQL 9种索引的原理和应用场景》
btree，适合任意单值类型，可用于=, >, <, >=, <=以及排序。
hash，当字段超过单个索引页的1/4时，不适合b-tree索引(因为b-tree存储原始值, 并且是双向链表.)。如果业务只有=的查询需求，使用hash index效率更高.
gin，倒排存储，（column value: row IDs tree|list）。适合多值列，也适合单值列。例如数组、全文检索、JSON、HSTORE等类型。
gist，适合数据有交错的场景，例如全文检索、range类型、空间类型(点、线、面、多维对象... ...)。
sp-gist，空间分区索引类型，适合不平衡数据集(例如xxxyyyzzz??????组成的VALUE，xxx, yyy, zzz，每个值包含一些数据集，每个数据集的数据量不平衡可能导致TREE不平衡)。
brin，块级索引，每个或每连续N个数据块的数据记录中, 被索引字段的数据范围。
bloom，支持被索引字段的任意组合的等值搜索。失真存储, 当搜索某个组合的记录时, 索引说存在不一定存在, 不存在一定不存在.
rum，支持全文检索类型，支持单值列+全文检索列，支持近似文本搜索。
zombodb，PG与ES搜索引擎结合的一种索引，在PG数据库中透明使用ES。
bitmap，支持1000~10000个唯一值的列。适合多个值的与或条件搜索。
hnsw,ivfflat, 如果你存储的是向量数据, 需要根据向量距离召回相似数据, 需要使用向量索引.

3、这个问题将影响哪些行业以及业务场景

通用, 但是这是富人的烦恼, 别的库没这么多索引种类

4、会导致什么问题?

一般用户不懂那么多, 通常只使用默认的btree, 使得无法达到最优化的数据库使用, 浪费资源

5、业务上应该如何避免这个坑

自己掌握这些索引的原理, 根据实际的业务需要进行选择.

6、业务上避免这个坑牺牲了什么, 会引入什么新的问题

学习门槛较高

7、数据库未来产品迭代如何修复这个坑

希望能在语法层支持自动分析, 自动推荐索引种类. 根据数据类型、数据分布、where 条件的表达式和操作符进行自动选择.
或者参考我github的文档: 《自动选择正确索引访问接口(btree,hash,gin,gist,sp-gist,brin,bitmap...)的方法》

往期吐槽文章：

欢迎大家留言或联系我把踩过的坑发过来, 一起鞭策开源和国产数据库:

1 德哥邀你鞭策数据库第1期 - PG MVCC

2 Tom Lane老师, 求求你别挤牙膏了, 先解决xid回卷的问题吧

3 为什么增加只读实例不能提高单条SQL的执行速度?

4 德哥邀你鞭策数据库第4期-逻辑日志居然只有全局开关

5 第5期吐槽:经常OOM?吃内存元凶找到了:元数据缓存居然不能共享

6 第6期吐槽:2024了还没用上DIO，不浪费内存才怪呢！

7 第7期吐槽:今年才等来slot failover，附上海DBA招聘信息

8 第8期吐槽:高并发短连接性能怎么这么差?

9 第9期鞭策:“最先进”的开源数据库上万连接就扛不动了,怪研发咯?

10 第10期吐槽:说删库跑路的都是骗子,千万别信,他们有的宝贝你可能没有!

11 第11期吐槽:关闭FPW来提升性能,你想过后果吗! 本期彩蛋-老板提出变态的要求,你会答应吗?

12 第12期吐槽:SQL执行计划不对？能好就见鬼了！优化器还在用几十年前的参数模板,环境自适应能力几乎为零

13 第13期吐槽:十个中年人有九个发福的，数据库用久了也会变胖！这一期吐槽PG膨胀收缩之痛，tom lane啊您为啥不根治膨胀呢？

14 吐槽(鞭策)PG以来我掉了“一半流量”!老外听不得忠言逆耳吗? (本期抽奖-掌上游戏机)

15 第15期吐槽:没有全局临时表,除了难受还有哪些潜在危害？

16 空缺,因为这一期的吐槽PG社区已经落实了.

17 第17期吐槽:被DDL坑过的人不计其数！严重时引起雪崩，危害仅次于删库跑路！PG官方不支持online DDL确实后患无穷

18 第18期吐槽:都走索引了为什么还要回表访问?原来是索引里缺少了“灵魂”

19 第19期吐槽:从DuckDB导入到PG后膨胀了5倍，把存储销售乐坏了！什么情况?

20 第20期吐槽:PG17新版本这么香，为什么不升级呢？居然是因为这个

21 第21期吐槽:90%的性能抖动是缺少这个功能造成的！也是DBA害怕开发去线上跑SQL的魔咒

22 第22期吐槽:DB容灾节点延迟了，网络带宽瓶颈？用CPU换啊！该“魔法”PG还不支持！

25 第25期吐槽:PG的物理Standby无法Partial导致单元化架构/SaaS使用不灵活

99 第99期吐槽:SQL hang住锁阻塞性能暴跌!抓不到捣蛋SQL的DBA很尴尬。

26 第26期吐槽:开发者使用PG的第1件事-配置访问控制策略，体验有待加强

27 第27期吐槽:block size既大又小！谁把成年人惯成这样的？

28 想撼动Oracle，PG系国产你还不配！吐槽你连最基本的空间分配都没做好

29 吐槽PG表空间搞得跟"玩具"一样，全靠ZFS来凑

30 快改密码！你的PG密码可能已经泄露了

31 注意别踩坑！PG大表又发现一处隐患

100 直播+吐槽: 看看你的PG有没有被注水? 聊聊孤儿文件

32 第32期吐槽: PG大表激怒架构师，分区后居然不能创建唯一约束？

33 有奖谜题：PG里100%会爆的定时炸弹是什么？

34 第34期吐槽:PG做SaaS/DBaaS？隔墙有耳。（本期彩蛋PG岗位招聘）

本期彩蛋-招商中,有需要的小伙伴可联系嵌入...

文章中的参考文档请点击阅读原文获得.

欢迎关注我的github (https://github.com/digoal/blog) , 学习数据库不迷路.

近期正在写公开课材料, 未来将通过视频号推出, 欢迎关注视频号:

继续滑动看下一个

PostgreSQL码农集散地

向上滑动看下一个

您可能也对以下帖子感兴趣

文章有问题？点此查看未经处理的缓存