我试图弄清楚 Prometheus 的increase()查询函数在进程重新启动时的行为。
当在 2m 间隔内有一个进程重新启动时,我查询:
sum(increase(my_metric_total[2m]))
Run Code Online (Sandbox Code Playgroud)
我得到的值低于预期。
例如,在一个简单的实验中,我模拟了:
全部在 2 分钟的间隔内。
查询时:
sum(increase(lcm_restarts[2m]))
Run Code Online (Sandbox Code Playgroud)
当我期待 5 时,我收到了 ~4.5 的值。
有人可以解释一下吗?