【发布时间】:2021-08-19 10:57:32
【问题描述】:
我正在尝试将我的两个资源 abc.pqr 和 abc.jkl 的阈值限制设置为 2 错误。我想在其中任何一个超过2 的阈值时触发警报和通知。我不想在聚合它们超过阈值限制时发出警报,而不是单独发出警报。
假设abc.pqr 有0 错误但abc.jkl 有3 错误,那么我应该得到类似abc.jkl has high error rate 的警报,而与abc.pqr 无关。
当我尝试通过 Add Query 选项进行聚合时,我得到了这样的最终查询
sum(last_10m):avg:trace.trace.annotation.errors{env:stage,service:xyz-stage,resource_name:abc.pqr}.as_count() + avg:trace.trace.annotation.errors{env:stage,service:xyz-stage,resource_name:abc.jkl}.as_count() > 2
当我尝试选择 OR 并在 from 之后添加更多选项时,最终查询是这样的。
sum(last_10m):avg:trace.trace.annotation.errors{env:stage AND service:xyz-stage AND resource_name:abc.pqr OR env:stage AND service:xyz-stage AND resource_name:abc.jkl}.as_count() > 2
我认为这不是对我想要实现的目标的有效查询。这在 datadog 中是否可行,或者我是否必须为这两个指标创建单独的监视器,即使它们具有相同的阈值?
【问题讨论】:
标签: datadog