浅谈PostgreSQL BgWriter的实现 postgresql
liebian365 2024-11-05 11:46 29 浏览 0 评论
作者:徐田原
1.前言
postgresql有后台进程bgwriter,它会定时刷新缓存到文件系统中。这种机制提高了缓存的替换速度,因为在寻找空闲缓存时,有时需要将脏页刷新到文件中,而刷新操作是比较耗时的。同样它也提高了执行checkpoint的完成速度,因为checkpoint需要刷新所有的脏页。
2.监控
BgWriter的监控只能从pg_stat_bgwriter视图查看,它只是记录了统计数据
ColumnTypeDescriptionbuffers_cleanbigintbgwriter刷新缓存的总数maxwritten_cleanbigint因为达到最大缓存刷新数目,而bgwriter退出的次数buffers_allocbigint用户的可用缓存分配数目
3.BgWriter进程
bgwriter进程的原理很简单,它只是定期的执行缓存刷新。它有两个状态,正常状态和冬眠状态。在正常状态下,bgwriter在刷新完缓存后,会等待时长bgwriter_delay(可以在postgresql.conf指定,默认值为200ms)。当连续两次都没有要刷新的缓存,那么就会进入冬眠状态,这时的等待时长变为50 * bgwriter_delay。
4.执行原理
BgWriter进程会维护了一些统计数据,这些数据会影响到刷新缓存的执行。在介绍下面内容之前,读者需要了解下clock sweep缓存替换算法,可以参考此篇文章。
5.确认遍历数目和位置
postgresql的缓存是由一个环形数组来表示,clock sweep算法会记录上次的遍历结束位置和已遍历的缓存轮数。我们把clock sweep算法的遍历位置记为strategy_id,缓存轮数记为strategy_pass。当然bgwriter也会记录上次的遍历结束位置和遍历轮数,分别记为next_to_clean_id和next_to_clean_passes。
首先确定遍历的缓存数目和起始位置。遍历的方向只能从前往后,并且需要此次bgwriter能够遍历到strategy_id。分为下面三种情况:
- next_to_clean_passes > strategy_pass并且strategy_id > next_to_clean_id,那么遍历数目为strategy_id - next_to_clean_id,否则不需要遍历。
- next_to_clean_passes == strategy_pass并且 next_to_clean_id > strategy_id,那么遍历数目为NBuffers - (next_to_clean - strategy_buf_id)
- 其他情况,遍历数目为NBuffers,起始位置为strategy_id,更新next_clean_id = strategy_id
6.预估缓存替换数目
bgwriter还会使用以往的缓存替换数据,来推断此次bgwriter的缓存需求数目和。
计算此次bgwriter的缓存需求数目,采用了平滑算法
recent_alloc表示距离上次bgwrite期间的缓存需求数
smoothing_samples参数为16,表示平滑程度。
smoothed_alloc表示平滑之后的平均值,初始值为0。
if (smoothed_alloc <= (float) recent_alloc)
// 为了保证此次缓存替换数目大,没有使用平滑算法
smoothed_alloc = recent_alloc;
else
// 计算平滑之后的值
smoothed_alloc += ((float) recent_alloc - smoothed_alloc) / smoothing_samples;
其实smoothed已经可以作为此次bgwriter到下次期间的缓存需求预估值,但是为了应对请求突然增大的情况,这里会再乘以bgwriter_lru_multiplier因子(可以在postgresql.conf配置)
?
// 计算预估值
upcoming_alloc_est = (int) (smoothed_alloc * bgwriter_lru_multiplier);
因为缓存遍历是从next_clean_id开始向后遍历,直到遇到strategy_id为止。而从strategy_id到next_clean_id的这段距离,是有其他进程遍历的,我们需要估算出这部分的可用缓存数量。
?
通过上次bgwriter到此次的统计数据来估算。这里先估算出来找到平均一个可用缓存需要遍历的缓存数目
?
// clock sweep遍历的缓存数目,缓存数组的长度为NBuffers
strategy_delta = strategy_buf_id - prev_strategy_buf_id;
strategy_delta += (long) passes_delta * NBuffers;
?
// 计算上次期间的平均遍历数目
scans_per_alloc = (float) strategy_delta / (float) recent_alloc;
// 平滑操作
?
smoothed_density += (scans_per_alloc - smoothed_density) / smoothing_samples;
strategy_id到next_to_clean_id这段距离,预估的可用缓存数目
?
reusable_buffers_est = (float) (NBuffers - bufs_to_lap) / smoothed_density;
7.执行完成条件
执行完成条件
bgwriter会从第一步计算出的遍历起始位置,开始遍历。
如果该缓存的引用次数或使用次数不为零,就会遍历下一个缓存。
如果该缓存的引用次数或使用次数都为零,认为该缓存是可用缓存。
如果该缓存为脏页,就刷新到文件并且发送局部sync请求后,也认为该缓存是可用缓存。
当它满足下面三个条件之一,就会认为此次bgwrite完成。
- 遍历的缓存数目已经达到结束位置(在第一步中确认遍历数目和位置)
- 遍历过程中,reusable_buffers_est + 遍历过程中的可用缓存数目 >= upcoming_alloc_est
- 刷新的数目超过了bgwriter_lru_maxpages(可以在postgresql.conf中配置)
8.局部sync
注意上面的脏页刷新只是写入到了文件系统的cache里,并不代表着持久化到磁盘,所以它会发送局部 sync 请求。当请求量超过了bgwriter_flush_after,就会处理堆积的 sync 请求。注意到这里是局部 sync 请求,它在处理时调用了sync_file_range方法,只是文件中指定的一段内容持久化到磁盘,而不是整个文件。
9.配置参数
名称含义默认值bgwriter_delay每次执行bgwriter的间隔时间200msbgwriter_lru_maxpages每次执行bgwriter,刷新缓存的最大数目100bgwriter_lru_multiplier在预估需要缓存数目的因子2bgwriter_flush_after当局部sync请求达到的最大数,会触发处理512KB
bgwriter_flush_after这个配置项比较特殊,如果没有附带单位,那么表示缓存的个数。如果有,表示缓存的容量。
相关推荐
- 深度解密epoll 如何工作的?(epoll基本处理流程)
-
epoll...
- 大乐透第19082期:头奖开出7注1000万分落六地 奖池41亿元
-
2019年7月17日晚开奖的体彩超级大乐透第19082期开奖号码为:前区06、18、20、21、31,后区03、04。本期大乐透前区号码五区比为1:0:3:0:1,二区和四区号码没有给出。当期前区和值...
- 【开奖】4月27日周六:福彩、体彩(2021年4月27日体彩开奖结果)
-
4月27日开奖福彩3D第2019110期:61222选5第2019110期:0812202122排列3第19110期:303排列5第19110期:30305大乐透第19047期:0304...
- “红狒狒”落户哈尔滨铁路局(哈尔滨铁路红肠)
-
这几天,“红人”“红狒狒”在牡丹江机务段可引起了不小的轰动,众粉丝争相与其拍照留念,在该段人气爆棚!“红狒狒”到底何许人也?“红狒狒”,中文名:和谐3D型电力机车;绰号:红狒狒、番茄;制造商:大连机...
- 2D、3D、2.5D,做游戏还是搞噱头?玩家都晕了
-
前言游戏类型就像某种潮流,一种流行罢,另一种接棒成为主流。前两年的新作大多以“开放世界”为标签,在追求纯沙盒的过程中打造出一些细致的分类,比如说“类GTA沙盒”。诚然,纯碎的沙盒游戏并不多见,业内只有...
- 《战神4》PC版宣传片发布 GTX 1070即可60帧畅玩
-
在今年10月的时候索尼PlayStation官方正式宣布圣莫尼卡2018年的《战神4》将于2022年1月14日推出PC版本,官方在今天公布了一段PC版宣传片,并且公开了游戏的配置需求。下面让我们一起来...
- 男星深情好丈夫形象崩塌,半夜搂美女坐大腿,举止亲密
-
近日,于晓光被拍到深夜在酒吧玩,结束后与一名女子一起上车离开。上车后,女子直接坐在了他腿上,他也顺势搂着美女,美女满脸笑容地坐在他腿上玩手机离开。可能有人会好奇,于晓光是谁呢?于晓光是韩国艺人秋瓷炫的...
- d3d12dll丢失怎么修复?d3d12dll加载失败怎么解决?
-
d3d12.dll丢失怎么修复?d3d12.dll加载失败怎么解决?很多朋友想要运行游戏的时候都会遇到这个问题,这种情况该怎么办呢?今天系统之家小编给朋友们讲讲具体的解决方法,操作其实还蛮简单的。...
- 许多玩家反馈《生化4RE》PC一直崩溃 无法进入游戏
-
今日(3月24日),卡普空《生化危机4:重制版》正式发售,然而有部分PC玩家遇到了游戏崩溃等问题。很多玩家在贴吧发帖称游戏遇到了严重的崩溃问题,且经常反复,报错代码普遍为FatalD3Derror...
- 微软正式推出适用于WSL Linux的D3D12 GPU视频加速技术
-
今天,微软正式向WindowsSubsystemforLinux(WSL)用户发布了Direct3D12GPU视频加速支持。在微软通过WSL允许在Linux下使用Open...
- 《怪物猎人:崛起》曙光系统报错“Fatal d3d error”的解决办法
-
《怪物猎人:崛起》曙光系统报错“Fatald3derror”的解决办法不少小伙伴反应《怪物猎人:崛起》DLC曙光预载以后打不开游戏,出现了Fatald3derror类似的错误代码,这类问题的解...
- Mac+双屏,前端程序员的专业配置 - Loctek 乐歌 D3D 双屏电脑显示器支架
-
做FE也有一段日子了,电脑屏幕每天在设计稿、浏览器、IDE、即时通讯工具、Terminal、邮箱之间切换。虽然mac的工作区带来了很多灵活,但是依然略显不足。于是入手支架,把公司配的电脑和显示器发挥起...
- RPC 的原理和简单使用(rpc详解)
-
RPC的概念RPC,RemoteProcedureCall,翻译成中文就是远程过程调用,是一种进程间通信方式。它允许程序调用另一个地址空间(通常是共享网络的另一台机器上)的过程或函数。在调用的...
- 大厂开源的golang微服务rpc框架 — kitex
-
提前rpc估计所有的开发同学都知道,不知道的也无所谓,毕竟我也好几年没用了,今天带大家在复习一下。RPC(RemoteProcedureCall):远程过程调用,...
- 干货!一文掌握Protobuf所有语言所有用法,快收藏
-
说实话,Protobuf这个库,让人相见时难别亦难,东风无力百花残,每次等到要用它的时候,总感觉还没有完全掌握它的用法,而实际上等去百度或者谷歌的时候,教程都是多么的凌乱不堪。学会它,最直接关系到的,...
你 发表评论:
欢迎- 一周热门
- 最近发表
- 标签列表
-
- wireshark怎么抓包 (75)
- qt sleep (64)
- cs1.6指令代码大全 (55)
- factory-method (60)
- sqlite3_bind_blob (52)
- hibernate update (63)
- c++ base64 (70)
- nc 命令 (52)
- wm_close (51)
- epollin (51)
- sqlca.sqlcode (57)
- lua ipairs (60)
- tv_usec (64)
- 命令行进入文件夹 (53)
- postgresql array (57)
- statfs函数 (57)
- .project文件 (54)
- lua require (56)
- for_each (67)
- c#工厂模式 (57)
- wxsqlite3 (66)
- dmesg -c (58)
- fopen参数 (53)
- tar -zxvf -c (55)
- 速递查询 (52)