アラート集約通知テンプレート¶
タイトル¶
您有 {{N}} 条{{等级}}アラート通知
内容¶
集約なし¶
您有 N 条新的Guanceアラート
第 1 / 2 条:
タイトル
内容
ワークスペースに移動して確認
ワークスペースに移動してAIインテリジェント分析を実行
第 2 / 2 条:
タイトル
内容
ワークスペースに移動して確認
ワークスペースに移動してAIインテリジェント分析を実行
- ワークスペースに移動して確認:イベントエクスプローラーに遷移し、現在のイベントを表示します(フィルター条件:
df_event_id)
図:
ルール集約¶
すべて¶
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
関連検出ルール:
- {{イベントタイトル}} >>確認
- 確認:エクスプローラーに遷移し、現在のモニターが集約期間内に生成したすべてのイベントを表示します(フィルター条件:
df_monitor_checker_id)
図:
検出ルール - モニター¶
検出タイプ:モニター
検出ルール名:{{ホスト}} CPU が {{Result}}% 超過
検出ルール ID:rule_cdbkjcbsdjcb1234445455
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
ワークスペースに移動して確認
- 確認:エクスプローラーに遷移し、現在のモニターに関連するイベントを表示します(フィルター条件:
df_monitor_checker_id)
検出ルール - インテリジェントインスペクション¶
検出タイプ:インテリジェントインスペクション
検出ルール名:{{ホスト}} CPU が {{Result}}% 超過
検出ルール ID:rule_cdbkjcbsdjcb1234445455
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
ワークスペースに移動して確認
ワークスペースに移動してAIインテリジェント分析を実行
- 確認:エクスプローラーに遷移し、現在のインテリジェントインスペクションルールに関連するイベントを表示します(フィルター条件:
df_monitor_checker_id)
検出ルール - SLO¶
検出タイプ:SLO
検出ルール名:{{ホスト}} CPU が {{Result}}% 超過
検出ルール ID:rule_cdbkjcbsdjcb1234445455
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
ワークスペースに移動して確認
ワークスペースに移動してAIインテリジェント分析を実行
- 確認:エクスプローラーに遷移し、現在の SLO に関連するイベントを表示します(フィルター条件:
df_monitor_checker_id)
検出ディメンション¶
検出ディメンション:service:kodo,host:test
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
関連検出ルール:
サービス{{service}}の応答時間がしきい値を超えました。至急確認してください >>確認
マシン{{host}}のCPU使用率がしきい値を超えました。至急確認してください >>確認
関連イベント:
serviceA の応答時間がしきい値を超えました。至急確認してください 4回
serviceB の応答時間がしきい値を超えました。至急確認してください 3回
hostA のCPU使用率がしきい値を超えました。至急確認してください 5回
hostB のCPU使用率がしきい値を超えました。至急確認してください 6回
タグ¶
タグ:service:kodo,host:test
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
関連検出ルール:
- {{イベントタイトル}} >>確認
- 確認:エクスプローラーに遷移し、現在の検出ルールに関連するイベントを表示します(フィルター条件:
df_monitor_checker_id)
図:
インテリジェント集約¶
タイトルクラスタリング¶
タイトル:{{ホスト}} CPU が {{Result}}% 超過
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
関連検出ルール:
サービス{{service}}の応答時間がしきい値を超えました。至急確認してください >>確認
マシン{{host}}のCPU使用率がしきい値を超えました。至急確認してください >>確認
関連イベント:
serviceA の応答時間がしきい値を超えました。至急確認してください 4回
serviceB の応答時間がしきい値を超えました。至急確認してください 3回
hostA のCPU使用率がしきい値を超えました。至急確認してください 5回
hostB のCPU使用率がしきい値を超えました。至急確認してください 6回
- 確認:エクスプローラーに遷移し、現在の検出ルールが集約期間内に生成したすべてのイベントを表示します(フィルター条件:
df_monitor_checker_id)
内容クラスタリング¶
タイトル:{{ホスト}} CPU が {{Result}}% 超過
関連イベント:123
集約期間:2023/11/20 10:00 ~ 2023/11/20 10:05
関連検出ルール:
サービス{{service}}の応答時間がしきい値を超えました。至急確認してください >>確認
マシン{{host}}のCPU使用率がしきい値を超えました。至急確認してください >>確認
関連イベント:
serviceA の応答時間がしきい値を超えました。至急確認してください 4回
serviceB の応答時間がしきい値を超えました。至急確認してください 3回
hostA のCPU使用率がしきい値を超えました。至急確認してください 5回
hostB のCPU使用率がしきい値を超えました。至急確認してください 6回
- 確認:エクスプローラーに遷移し、現在の検出ルールが集約期間内に生成したすべてのイベントを表示します(フィルター条件:
df_monitor_checker_id)
AI 集約¶
タイトル:title:本アラートの概要情報を説明します。
処理意見:suggestion: 現在のアラートに対する処理の提案です。
{xxx関連}アラート集約:"summary": "複数のホストでCPUとメモリの異常が発生し、最高異常値は98% (ホスト 172.16.200.108) でした。ホスト 1
関連検出ルール:df_monitor_checker_ids: 関連するモニター (ルール ID)。
{xxx関連}アラート集約:"summary": "複数のホストでCPUとメモリの異常が発生し、最高異常値は98% (ホスト 172.16.200.108) でした。ホスト 1
関連検出ルール:df_monitor_checker_ids: 関連するモニター (ルール ID)。
例:
タイトル:集約期間内に、合計3つのモニターがアラートイベントをトリガーし、19件のアラート通知が生成されました。
処理意見:高頻度でアラートが発生しているホストを優先的に処理してください。ホスト 172.16.200.101 はCPU異常、メモリ異常、通信問題に関連しており、全面的な確認が必要です。アラートの相関性を確認してください。複数のモニター (ルール ID) がホストリソース (CPU、メモリ) およびモジュール通信に関連しており、システム全体の問題である可能性があります。監視戦略を最適化し、短時間で重複してトリガーされるアラートを減らし、時間ウィンドウを組み合わせてアラートのノイズ低減処理を行ってください。
ホスト関連アラート集約:複数のホストでCPUとメモリの異常が発生し、最高異常値は98% (ホスト 172.16.200.108) でした。ホスト 172.16.200.101 はCPUとメモリの両方のアラートをトリガーしているため、重点的に確認する必要があります。
関連検出ルール: title 確認("rul_e68e2d5e620b40c691128a399de3f479")
アプリケーション関連アラート集約:複数のホストでCPUとメモリの異常が発生し、最高異常値は98% (ホスト 172.16.200.108) でした。ホスト 172.16.200.101 はCPUとメモリの両方のアラートをトリガーしているため、重点的に確認する必要があります。
関連検出ルール:title 確認("rul_e68e2d5e620b40c691128a399de3f479")
図:





