0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

小规模的web应用该怎么设置

马哥Linux运维 来源:马哥Linux运维 2023-05-22 16:06 次阅读

我在研究HikariCP(一个数据库连接池)时无意间在HikariCP的Github wiki上看到了一篇文章(即前面给出的链接),这篇文章有力地消除了我一直以来的疑虑,看完之后感觉神清气爽。故在此做译文分享。

接下来是正文

数据库连接池的配置是开发者们常常搞出坑的地方,在配置数据库连接池时,有几个可以说是和直觉背道而驰的原则需要明确。

1万并发用户访问

想象你有一个网站,压力虽然还没到Facebook那个级别,但也有个1万上下的并发访问——也就是说差不多2万左右的TPS。那么这个网站的数据库连接池应该设置成多大呢?结果可能会让你惊讶,因为这个问题的正确问法是:

“这个网站的数据库连接池应该设置成多呢?”

下面这个视频Oracle Real World Performance Group发布的,请先看完:
http://www.dailymotion.com/video/x2s8uec

(因为这视频是英文解说且没有字幕,我替大家做一下简单的概括:)
视频中对Oracle数据库进行压力测试,9600并发线程进行数据库操作,每两次访问数据库的操作之间sleep 550ms,一开始设置的中间件线程池大小为2048:

bc634e00-f6a6-11ed-90ce-dac502259ad0.png

初始的配置

压测跑起来之后是这个样子的:

bc982fda-f6a6-11ed-90ce-dac502259ad0.png

2048连接时的性能数据

每个请求要在连接池队列里等待33ms,获得连接后执行SQL需要77ms

此时数据库的等待事件是这个熊样的:

bcd07322-f6a6-11ed-90ce-dac502259ad0.png

各种buffer busy waits

各种buffer busy waits,数据库CPU在95%左右(这张图里没截到CPU)

接下来,把中间件连接池减到1024(并发什么的都不变),性能数据变成了这样:

bcebc3a2-f6a6-11ed-90ce-dac502259ad0.png

连接池降到1024后

获取链接等待时长没怎么变,但是执行SQL的耗时减少了。
下面这张图,上半部分是wait,下半部分是吞吐量

wait和吞吐量

能看到,中间件连接池从2048减半之后,吐吞量没变,但wait事件减少了一半。

接下来,把数据库连接池减到96,并发线程数仍然是9600不变。

bd011554-f6a6-11ed-90ce-dac502259ad0.png

96个连接时的性能数据

队列平均等待1ms,执行SQL平均耗时2ms。

bd1fb84c-f6a6-11ed-90ce-dac502259ad0.jpg

wait事件几乎没了,吞吐量上升。

没有调整任何其他东西,仅仅只是缩小了中间件层的数据库连接池,就把请求响应时间从100ms左右缩短到了3ms。

But why?

为什么nginx只用4个线程发挥出的性能就大大超越了100个进程的Apache HTTPD?回想一下计算机科学的基础知识,答案其实是很明显的。

即使是单核CPU的计算机也能“同时”运行数百个线程。但我们都[应该]知道这只不过是操作系统用时间分片玩的一个小把戏。一颗CPU核心同一时刻只能执行一个线程,然后操作系统切换上下文,核心开始执行另一个线程的代码,以此类推。给定一颗CPU核心,其顺序执行AB永远比通过时间分片“同时”执行AB要快,这是一条计算机科学的基本法则。一旦线程的数量超过了CPU核心的数量,再增加线程数系统就只会更慢,而不是更快。

这几乎就是真理了……

有限的资源

上面的说法只能说是接近真理,但还并没有这么简单,有一些其他的因素需要加入。当我们寻找数据库的性能瓶颈时,总是可以将其归为三类:CPU、磁盘、网络。把内存加进来也没有错,但比起磁盘和网络,内存的带宽要高出好几个数量级,所以就先不加了。

如果我们无视磁盘和网络,那么结论就非常简单。在一个8核的服务器上,设定连接/线程数为8能够提供最优的性能,再增加连接数就会因上下文切换的损耗导致性能下降。数据库通常把数据存储在磁盘上,磁盘又通常是由一些旋转着的金属碟片和一个装在步进马达上的读写头组成的。读/写头同一时刻只能出现在一个地方,然后它必须“寻址”到另外一个位置来执行另一次读写操作。所以就有了寻址的耗时,此外还有旋回耗时,读写头需要等待碟片上的目标数据“旋转到位”才能进行操作。使用缓存当然是能够提升性能的,但上述原理仍然成立。

在这一时间段(即"I/O等待")内,线程是在“阻塞”着等待磁盘,此时操作系统可以将那个空闲的CPU核心用于服务其他线程。所以,由于线程总是在I/O上阻塞,我们可以让线程/连接数比CPU核心多一些,这样能够在同样的时间内完成更多的工作。

那么应该多多少呢?这要取决于磁盘。较新型的SSD不需要寻址,也没有旋转的碟片。可别想当然地认为“SSD速度更快,所以我们应该增加线程数”,恰恰相反,无需寻址和没有旋回耗时意味着更少的阻塞,所以更少的线程[更接近于CPU核心数]会发挥出更高的性能。只有当阻塞创造了更多的执行机会时,更多的线程数才能发挥出更好的性能

网络和磁盘类似。通过以太网接口读写数据时也会形成阻塞,10G带宽会比1G带宽的阻塞少一些,1G带宽又会比100M带宽的阻塞少一些。不过网络通常是放在第三位考虑的,有些人会在性能计算中忽略它们。bd319e5e-f6a6-11ed-90ce-dac502259ad0.png

上图是PostgreSQL的benchmark数据,可以看到TPS增长率从50个连接数开始变缓。在上面Oracle的视频中,他们把连接数从2048降到了96,实际上96都太高了,除非服务器有16或32颗核心。

计算公式

下面的公式是由PostgreSQL提供的,不过我们认为可以广泛地应用于大多数数据库产品。你应该模拟预期的访问量,并从这一公式开始测试你的应用,寻找最合适的连接数值。

连接数 = ((核心数 * 2) + 有效磁盘数)

核心数不应包含超线程(hyper thread),即使打开了hyperthreading也是。如果活跃数据全部被缓存了,那么有效磁盘数是0,随着缓存命中率的下降,有效磁盘数逐渐趋近于实际的磁盘数。这一公式作用于SSD时的效果如何尚未有分析。

按这个公式,你的4核i7数据库服务器的连接池大小应该为((4 * 2) + 1) = 9。取个整就算是是10吧。是不是觉得太小了?跑个性能测试试一下,我们保证它能轻松搞定3000用户以6000TPS的速率并发执行简单查询的场景。如果连接池大小超过10,你会看到响应时长开始增加,TPS开始下降。

笔者注:
这一公式其实不仅适用于数据库连接池的计算,大部分涉及计算和I/O的程序,线程数的设置都可以参考这一公式。我之前在对一个使用Netty编写的消息收发服务进行压力测试时,最终测出的最佳线程数就刚好是CPU核心数的一倍。

公理:你需要一个小连接池,和一个充满了等待连接的线程的队列

如果你有10000个并发用户,设置一个10000的连接池基本等于失了智。1000仍然很恐怖。即是100也太多了。你需要一个10来个连接的小连接池,然后让剩下的业务线程都在队列里等待。连接池中的连接数量应该等于你的数据库能够有效同时进行的查询任务数(通常不会高于2*CPU核心数)。

我们经常见到一些小规模的web应用,应付着大约十来个的并发用户,却使用着一个100连接数的连接池。这会对你的数据库造成极其不必要的负担。

审核编辑:彭静
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • cpu
    cpu
    +关注

    关注

    68

    文章

    10456

    浏览量

    206590
  • 数据库
    +关注

    关注

    7

    文章

    3592

    浏览量

    63381
  • Web应用
    +关注

    关注

    0

    文章

    16

    浏览量

    3447

原文标题:数据库链接池终于搞对了,这次直接从100ms优化到3ms!

文章出处:【微信号:magedu-Linux,微信公众号:马哥Linux运维】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    贴片机中小规模生产

      对于拥有中、小规模生产的企业,由于产品的品种多,往往周期紧,则企业自身需求的是对贴片机的机种的转换快捷和操作灵活性等提出要求,—般企业拥有2~3条生产线。这种生产线配置如图1和图2所示。  图1
    发表于 11-27 10:16

    请问怎么设计一种小规模的大数值运算器?

    怎么设计一种小规模的大数值运算器?CSTU安全芯片体系结构是怎么的?
    发表于 04-19 10:53

    用中小规模集成芯片设计并制作一种双工对讲机

    的应用。(3)通过实验了解功率放大电路、电源升压电路的主要技术指标。 课程设计任务和基本要求 设计任务:用中小规模集成芯片设计并制作一对实现甲乙双...
    发表于 11-11 08:20

    小规模集成芯片电气特性测试

    小规模集成芯片电气特性测试:(1)熟悉数字电路实验箱的基本功能和使用方法,进一步熟悉示波器和数字万用表的使用。(2)掌握TTL与非门基本电参数的测试方法,了解TTL集
    发表于 10-29 22:05 0次下载

    三星2010存储芯片将出现小规模短缺情况

    三星2010存储芯片将出现小规模短缺情况 据国外媒体报道,全球最大的记忆体芯片制造商韩国三星电子周三表示,该公司目标要在三年内将半导体业
    发表于 11-02 16:09 674次阅读

    如何在Win 2003环境中设置一个Web服务器

    如何在Win 2003环境中设置一个Web服务器   本文介绍了如何在 Windows Server 2003 环境中设置一个用于匿名访问的WWW服务器。  
    发表于 01-29 11:35 537次阅读

    多相技术以小规模实现大型滤波器

    多相技术以小规模实现大型滤波器 引言 在现代电子系统中,到处都可以看到数字信号处理( DSP )的应用,从MP3播放器、数码相机到手机。DSP设计人员的工
    发表于 04-01 11:33 1151次阅读
    多相技术以<b class='flag-5'>小规模</b>实现大型滤波器

    针对电信和数据通信应用的400V_DC微电网小规模演示系统介绍

    针对电信和数据通信应用的400V DC微电网小规模演示系统
    发表于 01-07 11:30 0次下载

    针对电信和数据通信应用的400V DC微电网小规模演示系统

    针对电信和数据通信应用的400V DC微电网小规模演示系统
    发表于 06-02 15:41 0次下载

    一种小规模LCD驱动电路IP核的设计

    一种小规模LCD驱动电路IP核的设计
    发表于 01-14 12:35 11次下载

    百度与金龙客车合作,国内首款量产无人驾驶巴士将于2018年实现小规模量产及试运营

    10月17日晚间消息,百度今天与金龙客车签署战略合作协议,将于2018年实现商用级无人驾驶微循环车的小规模量产及试运营。百度方面表示,此次合作也意味着国内首款无人驾驶巴士量产。
    发表于 10-18 16:29 712次阅读

    百度Apollo无人驾驶车在今年开始小规模下放

    百度Apollo无人驾驶车整体生态都非常活跃,到现在已经有近百个合作伙伴。近日百度表示,Apollo无人驾驶车2018年会小规模下线,和金龙小客车进行L4级别合作。
    发表于 01-19 12:25 1033次阅读

    JDI开始为苹果小规模试生产AMOLED屏幕,可短期内实现企业挽救

    据外媒报道,JDI已经开始为苹果小规模试生产AMOLED屏幕。根据此前多方媒体报道的消息,日本显示器公司(JDI)与苹果在今年4月份曾签署了一项协议,将为其智能手表提供AMOLED屏幕。
    的头像 发表于 10-12 14:32 2239次阅读

    创造亿万人之中只属于你的那个“人”:微软Avatar Framework小规模公测

    (2020年1月17日 北京) 微软小冰团队宣布,将于下周三开始,分批启动Avatar Framework的小规模公开测试。如测试顺利,将按既定计划,于今年春季正式公开发布全新的Avatar
    的头像 发表于 01-17 13:09 1314次阅读

    百望云紧急完成系统升级,可满足小规模纳税人3%减征1%开票新政

    1月9日,国家税务总局发布了财税2023年1号公告,明确增值税小规模纳税人减免增值税优惠政策,百望云已紧急完成系统升级,可满足小规模纳税人3%减征1%开票新政,帮助用户准确快速开具发票。 总体上
    的头像 发表于 01-13 18:18 375次阅读
    百望云紧急完成系统升级,可满足<b class='flag-5'>小规模</b>纳税人3%减征1%开票新政