【问题标题】:JSON analog of GCP Monitoring alert policy in console控制台中 GCP 监控警报策略的 JSON 模拟
【发布时间】:2020-02-27 23:10:55
【问题描述】:

我希望 GCP 在我的一个云功能出现错误时发送警报,该云功能计划使用调度程序定期触发。我进入控制台并创建了一个看起来像这样的策略

policy in console - 简而言之,我正在监控云函数错误执行计数。如果错误计数在 1 小时内高于 0,我应该收到警报。

现在我的问题有两个。

  1. 基于上述条件,我有any time series violates above 0 for 1 hour。如果我不关闭这些错误(可能是 30 天),即使该功能当前执行成功,我仍然会收到正确的警报吗?有没有办法只在MOST RECENT time series violates above 0 for 1 hour 时发出警报?如果是这样,我怎么能用 JSON 格式写这个?
  2. 上面显示的 GCP 监控警报策略的 JSON 模拟是什么?

我拼凑了可以在文档中找到的信息。这是我目前所拥有的。

{
  "conditions": [
    {
       "conditionThreshold": {
       "comparison": "COMPARISON_GT",
       "duration": "3600s",
       "filter": "metric.type=\"cloudfunctions.googleapis.com/function/execution_count" AND 
                  resource.type=\"cloud_function\" AND 
                  function_name=\"function-1\" AND
                  status=\"error\"",
       "thresholdValue": 0,
       "trigger": {
          "count": 1
        }
      }
    }
  ],
}

我是 StackExchange 的新手,所以如果我的问题格式不正确,请告诉我。非常感谢您的时间和帮助!

【问题讨论】:

    标签: google-cloud-monitoring


    【解决方案1】:
    1. 一旦触发事件的条件不再成立,警报策略导致的事件将自动resolve。你不需要做任何事情来“关闭”错误,除非你只是想抑制更多的通知,这就是“acknowledge”的用途。没有可用的“最近”时间序列条件;您可能需要为每个函数创建单独的警报策略 - 而且您似乎已经在这样做了。

    2. 您认为这个 JSON 不正确有什么原因吗?我建议根据您遇到的问题提出问题,而不是在您自己验证您的代码/工作之前让其他人验证您的代码/工作。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2021-01-26
      • 1970-01-01
      • 2022-06-20
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-07-11
      • 1970-01-01
      相关资源
      最近更新 更多