为什么 RDS 突发余额看似随机,从未低于 99%,并且与系统流量不相关?

CFL*_*eff 6 database amazon-web-services amazon-rds amazon-cloudwatch

我正在尝试理解过去几个月看到的 RDS“突发平衡”指标。根据 CloudWatch 中报告的指标,我的突发余额似乎从未低于 99%,但有时它会在数周内保持在 99% 附近,有时会很快恢复到 100%。下图是2020年5月1日至2020年7月23日之间的突发余额。

在此输入图像描述

我很困惑,因为该指标与任何其他指标(例如负载均衡器报告的系统流量)之间似乎没有相关性。另外 - 为什么它永远不会低于 99%,为什么有时需要几周时间才能恢复到 100%,即使每天下午 5:00 以后我的系统上的流量很少,周末几乎没有?这是同一时间段内我的系统流量(负载均衡器请求计数):

在此输入图像描述

当系统流量非常可预测且重复时,为什么会出现突发平衡?

Chr*_*ams 8

突发余额与 RDS 实例上的磁盘使用情况相关。

假设您使用的是可破坏的 GP2 卷(它的积分也可以耗尽)。T2与突发实例类 ( / )一样,T3GP2 具有可用积分余额,其 IOP 最高可达 3000 PIOP。

GP2 提供的专用 IOP 是实例 GiB 存储数量的 3 倍(例如,如果您有 100 GiB 的存储,那么您将保证 300 PIOP,超过此数量的任何内容都将使用您的积分)。

一旦超过这个数字,您将开始耗尽这个余额,但当低于这个数字时,就会补充。当它处于 PIOP 使用的风口浪尖时,您可能不会补充或获得平衡(如您所见)。

要查看有关使用情况的更多信息,请从 CloudWatch 指标中检查 RDS 实例的读写操作。您可以将其与性能洞察结合起来,以查找可能导致此情况的任何特定操作。

有关I/O 积分和突发性能的更多信息可从文档中获取。