關於異常偵測

您目前查看的是 Apigee Edge 說明文件。
前往 Apigee X 說明文件
info

API 監控可讓您建立模式型規則,根據一組預先定義的條件觸發快訊。這類快訊稱為「固定」快訊,也是 API 監控服務在初始版本中支援的唯一快訊類型。

舉例來說,當您在下列情況下引發固定警告:

  • [rate of 5xx errors] [is greater than] [10%] for [10 minutes] from [target mytarget1]
  • [count of 2xx errors] [is less than] [50] for [5 minutes] in [region us-east-1]
  • [proxy myproxy1] 的 [p90 延遲時間] [大於] [750 毫秒] [10 分鐘]

當符合固定快訊的條件時,API 監控會發出快訊,通知您發生問題。不過,您必須先定義特定警報條件,API 監控功能才能發出警報。

固定快訊很有價值,但隨著流量模式隨時間變化,可能難以判斷條件的適當門檻。舉例來說,如果門檻設得太低,系統就會發出大量快訊。如果門檻設得太高,可能會錯過一些重大問題或服務中斷情形。

異常偵測

有了異常偵測功能,您不必自行預先判斷,Edge 就會偵測流量和效能問題。Edge 會自動在機構、環境和區域層級尋找異常狀況。系統偵測到異常狀況時,會記錄下來,並顯示在 Edge UI 的事件資訊主頁中。

異常偵測功能會將人工智慧 (AI) 和機器學習 (ML) 模型套用至歷來的 API 資料。 異常偵測功能隨後會針對您未曾想過的情況即時發出快訊,有助於提高工作效率,並縮短 API 問題的平均解決時間 (MTTR)。

舉例來說,如果新版 API 導致流量意外暴增,API 的延遲時間也隨之增加,系統就會偵測到異常情況。或者,後端發布版本設定有誤,導致 API 回報的後端錯誤增加。

偵測到的異常狀況包含下列資訊:

  • 導致異常的指標,例如 Proxy 延遲或 HTTP 錯誤代碼。
  • 異常狀況門檻。門檻可設為「輕微」、「中等」或「嚴重」

舉例來說,Edge 可以自動偵測異常狀況,例如:

  • [environment prod, region region1] 的 [503 錯誤] [略有增加]
  • [環境 prod,區域 region2] 的 [4xx 錯誤] [中等] [增加]
  • [環境 prod,區域 region3] 的 [延遲時間大幅增加] [嚴重]

從「事件」資訊主頁顯示的異常資訊,您可以建立新的快訊類型 (稱為「異常狀況」快訊),以便在發生這些情況時收到通知。

異常狀況類型

Edge 會自動偵測下列類型的異常狀況:

  • 機構、環境和區域層級的 HTTP 503 錯誤增加
  • 機構、環境和區域層級的 HTTP 504 錯誤增加
  • 機構、環境和區域層級的所有 HTTP 4xx 或 5xx 錯誤增加
  • 組織、環境和區域層級的第 90 個百分位數 (p90) 回應延遲時間總和增加

啟用異常偵測功能

根據預設,Edge 機構和環境會停用異常偵測功能。如要啟用異常偵測功能,請向 Apigee Edge 支援團隊提出要求,為特定機構和環境啟用這項功能。Apigee 會評估您的環境,並通知您是否可以啟用異常偵測功能。

基於效能考量,請勿在所有機構和環境中啟用異常偵測功能。 Apigee 建議您只在平均流量負載至少為每秒 10 筆交易 (tps) 的機構和環境中啟用異常偵測功能。

檢查是否已啟用異常偵測功能

如要檢查是否已啟用異常偵測功能,請按照下列步驟操作:

  1. 在 Edge UI 中,依序選取「Analyze」>「Alert Rules」
  2. 選取「+ Alert」(新增快訊) 按鈕。系統會開啟「建立快訊」面板:

    設定異常狀況快訊
  3. 選取所需環境

    如果「警示類型」的「異常」選項顯示為灰色,表示異常偵測功能已停用。