0

0

postgresql优化器如何做成本估算_postgresqlcost模型解析

舞姬之光

舞姬之光

发布时间:2025-11-21 16:35:03

|

874人浏览过

|

来源于php中文网

原创

PostgreSQL成本模型通过启动成本、总成本及I/O与CPU权重估算执行计划优劣,依赖统计信息与可调参数(如seq_page_cost、random_page_cost)反映硬件特性,结合表扫描、索引扫描等成本计算方式,指导查询优化。

postgresql优化器如何做成本估算_postgresqlcost模型解析

PostgreSQL优化器在生成执行计划时,会通过成本估算来比较不同执行路径的优劣,从而选择理论上执行最快的一条路径。这个过程依赖于一个称为“成本模型”的机制。理解该模型有助于我们写出更高效的SQL,也能帮助DBA调优查询性能。

成本模型的基本组成

PostgreSQL的成本模型将执行计划的总成本分为三部分:

  • 启动成本(Startup Cost):在开始返回第一行数据之前所需的成本,比如排序、物化等操作的开销。
  • 总成本(Total Cost):从开始执行到返回所有结果的预估总成本。
  • I/O与CPU成本权重:模型中对磁盘I/O和CPU计算分别赋予不同的权重,默认情况下:

这些权重由以下参数控制:

  • seq_page_cost:顺序读取一页的I/O成本,默认为1.0
  • random_page_cost:随机读取一页的I/O成本,默认为4.0(SSD场景建议调低)
  • cpu_tuple_cost:处理每一行元组的CPU成本,默认0.01
  • cpu_index_tuple_cost:处理每个索引项的CPU成本,默认0.005
  • cpu_operator_cost:执行一次操作(如比较)的CPU成本,默认0.0025
  • parallel_setup_cost:启动并行工作进程的开销
  • parallel_tuple_cost:并行执行中传输每行数据的成本

这些参数可在postgresql.conf中调整,也可通过SET命令临时修改,用于适应实际硬件环境(如使用SSD时降低random_page_cost)。

如何估算表扫描成本

全表扫描(Sequential Scan)的成本计算方式如下:

启动成本 = 0  
I/O成本 = seq_page_cost × 表的页面数(relpages)  
CPU成本 = cpu_tuple_cost × 表的元组数(reltuples)  
总成本 = I/O成本 + CPU成本

例如,一张表有10,000个数据页,100,000行记录:

  • I/O成本 = 1.0 × 10000 = 10000
  • CPU成本 = 0.01 × 100000 = 1000
  • 总成本 ≈ 11000

注意:实际还会加上轻微的启动成本和函数操作开销。

索引扫描的成本估算

索引扫描(Index Scan)的成本更为复杂,主要包括:

  • 索引访问I/O成本:依据索引层级和需读取的索引页数量
  • 回表(Heap Fetch)成本:根据命中行数读取主表数据页
  • 索引项处理的CPU成本

以B-tree索引为例,其成本大致为:

启动成本 = 索引定位开销(一般较小)  
I/O成本 = 
  random_page_cost × 索引页访问数 +
  random_page_cost × 预估需回表的数据页数
CPU成本 = 
  cpu_index_tuple_cost × 扫描的索引项数 +
  cpu_tuple_cost × 返回的元组数

如果查询选择性高(返回大量数据),优化器可能认为全表扫描更便宜;反之,选择性低时索引扫描更优。

音剪
音剪

喜马拉雅旗下的一站式AI音频创作平台,强大的在线剪辑能力,帮你轻松创作优秀的音频作品

下载

PostgreSQL还支持“位图扫描(Bitmap Scan)”,适用于多个索引组合的情况。它先用索引构建一个位图标记匹配的TID,再统一读取数据页,减少随机I/O次数。

统计信息的作用

成本估算高度依赖系统统计信息,主要来自:

  • pg_class.reltuplesrelpages:表的行数和页面数
  • pg_stats:列的唯一值数量、最常见值、频率直方图等
  • ANALYZE命令收集的统计信息直接影响选择率估算

若统计信息不准确(如大批次插入后未analyze),可能导致成本估算偏差,进而选择错误的执行计划。

查看执行计划中的成本

使用EXPLAIN可查看优化器估算的成本:

EXPLAIN SELECT * FROM users WHERE id = 1;

输出示例:

Index Scan using users_pkey on users  
  (cost=0.43..8.45 rows=1 width=204)

其中:

  • 0.43 是启动成本
  • 8.45 是总成本
  • rows=1 是预估返回行数
  • width=204 是预估每行平均字节

结合EXPLAIN ANALYZE还能看到实际执行时间,用于对比估算是否准确。

基本上就这些。理解PostgreSQL的成本模型,关键是掌握I/O与CPU的权衡、统计信息的影响以及硬件参数的适配。不复杂但容易忽略细节。

相关专题

更多
数据分析工具有哪些
数据分析工具有哪些

数据分析工具有Excel、SQL、Python、R、Tableau、Power BI、SAS、SPSS和MATLAB等。详细介绍:1、Excel,具有强大的计算和数据处理功能;2、SQL,可以进行数据查询、过滤、排序、聚合等操作;3、Python,拥有丰富的数据分析库;4、R,拥有丰富的统计分析库和图形库;5、Tableau,提供了直观易用的用户界面等等。

683

2023.10.12

SQL中distinct的用法
SQL中distinct的用法

SQL中distinct的语法是“SELECT DISTINCT column1, column2,...,FROM table_name;”。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

321

2023.10.27

SQL中months_between使用方法
SQL中months_between使用方法

在SQL中,MONTHS_BETWEEN 是一个常见的函数,用于计算两个日期之间的月份差。想了解更多SQL的相关内容,可以阅读本专题下面的文章。

347

2024.02.23

SQL出现5120错误解决方法
SQL出现5120错误解决方法

SQL Server错误5120是由于没有足够的权限来访问或操作指定的数据库或文件引起的。想了解更多sql错误的相关内容,可以阅读本专题下面的文章。

1095

2024.03.06

sql procedure语法错误解决方法
sql procedure语法错误解决方法

sql procedure语法错误解决办法:1、仔细检查错误消息;2、检查语法规则;3、检查括号和引号;4、检查变量和参数;5、检查关键字和函数;6、逐步调试;7、参考文档和示例。想了解更多语法错误的相关内容,可以阅读本专题下面的文章。

357

2024.03.06

oracle数据库运行sql方法
oracle数据库运行sql方法

运行sql步骤包括:打开sql plus工具并连接到数据库。在提示符下输入sql语句。按enter键运行该语句。查看结果,错误消息或退出sql plus。想了解更多oracle数据库的相关内容,可以阅读本专题下面的文章。

676

2024.04.07

sql中where的含义
sql中where的含义

sql中where子句用于从表中过滤数据,它基于指定条件选择特定的行。想了解更多where的相关内容,可以阅读本专题下面的文章。

575

2024.04.29

sql中删除表的语句是什么
sql中删除表的语句是什么

sql中用于删除表的语句是drop table。语法为drop table table_name;该语句将永久删除指定表的表和数据。想了解更多sql的相关内容,可以阅读本专题下面的文章。

417

2024.04.29

PS使用蒙版相关教程
PS使用蒙版相关教程

本专题整合了ps使用蒙版相关教程,阅读专题下面的文章了解更多详细内容。

23

2026.01.19

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
CSS3 教程
CSS3 教程

共18课时 | 4.7万人学习

Sass 教程
Sass 教程

共14课时 | 0.8万人学习

Pandas 教程
Pandas 教程

共15课时 | 0.9万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号