ステータスページ¶
Guanceは Status Page(サービスステータスページ)を提供しています。このページでは、各サイトのサービス稼働状況、SLO 信頼性の結果、および過去のインシデントやメンテナンス記録を確認できます。
当社はすべてのサイトのサービス状況を継続的に監視しています。サービスに問題が発生した場合、チームは直ちに対応し処理を行います。使用中に異常が発生した場合、まず Guance のサービスステータスを確認し、プラットフォームサービスの一時的な変動が原因かどうかを判断することをお勧めします。例えば、ログのアップロードに失敗した場合は、まず Guance のログサービスが正常かどうかを確認してください。
サービスサイト¶
ナビゲーションバーから ヘルプ > Status Page に移動します:
購読ボタンをクリックすると、このサイトのサービス稼働状況の監視を開始できます。購読後、サービスに異常が発生した場合、メール通知を受け取ります。
注意
Guance は、サイト内のワークスペースの各機能モジュールを継続的に監視します。1 分/回の頻度で検出し、5 分ごとに結果を集約します。5 分間のうちに 1 回でも異常が検出された場合、その期間は異常と判定されます。あるモジュールで 30 分間(連続 6 回の集計)連続して異常が検出された場合、アラートメールがトリガーされます。初回アラート後、当該モジュールの次の 5 分間の集計結果が正常に戻った場合、異常イベントは終了したと判定されます。
以下のリンクから直接 Guance の各サイトのサービスステータスを確認できます:
| サイト | ログイン URL | プロバイダー |
|---|---|---|
| 中国リージョン1(杭州) | https://auth.guance.com/ | Alibaba Cloud(中国杭州) |
| 中国リージョン2(寧夏) | https://aws-auth.guance.com/ | AWS(中国寧夏) |
| 中国リージョン4(広州) | https://cn4-auth.guance.com/ | Huawei Cloud(中国広州) |
| 中国リージョン6(香港) | https://cn6-auth.guance.com/ | Alibaba Cloud(国際站) |
| 米国リージョン1(オレゴン) | https://us1-auth.guance.com/ | AWS(米国オレゴン) |
| アジアパシフィックリージョン1(シンガポール) | https://ap1-auth.guance.com/ | AWS(シンガポール) |
| 欧州リージョン1(フランクフルト) | https://eu1-auth.guance.com/ | AWS(フランクフルト) |
| インドネシアリージョン1(ジャカルタ) | https://id1-auth.guance.com/ | Tencent Cloud(ジャカルタ) |
| アフリカリージョン1(南アフリカ) | https://za1-auth.guance.com/ | Huawei Cloud(南アフリカ) |
| 中東リージョン1(アラブ首長国連邦) | https://me1-auth.guance.com/ | AWS(アラブ首長国連邦) |
サービスステータス¶
各サイトのサービスは、以下のステータスのいずれかになる可能性があります:
| サービスステータス | 状態の説明 |
|---|---|
| 正常 | 現在のサイトのサービスが正常に動作していることを示します |
| 異常 | 現在のサイトのサービスに異常が発生し、データのアップロード、処理、またはクエリに影響を与える可能性があることを示します |
| 遅延 | 現在のサイトのサービスは引き続き使用可能ですが、データ処理またはクエリに遅延が発生する可能性があることを示します |
| メンテナンス | Guance の技術者が関連サービスに対してメンテナンスを実施していることを示します |
異常/遅延の判断ロジック¶
Status Page は、1 次機能モジュールごとにサービスステータスを表示します。データアップロード、データ処理、データクエリなどの 2 次項目は分割しません。現在、以下のモジュールをカバーしています:
| 1 次機能モジュール | 1 次機能モジュール |
|---|---|
| イベント | インフラストラクチャー |
| RUM | APM |
| メトリクス | ログ |
| Synthetic モニタリング | CI 可視化 |
| セキュリティ | モニター |
| インシデントセンター | エラーセンター |
| 統合カタログ | Agent 監視 |
| プラットフォームアクセス | シーンとダッシュボード |
| OpenAPI | 通知サービス |
システムは、各モジュールの監視結果に基づいてサービスステータスを判断します。モジュールによって使用される監視指標は異なる場合があります。以下の表は、判断の一部の例です:
判断項目 |
判断条件 | サービスステータス | サンプル説明 |
|---|---|---|---|
| データプッシュ失敗率 | 90% 超 | 異常 | ログデータを収集し、Kodo からメッセージキューにデータをプッシュする際の失敗率が 90% を超えた場合、ログサービスのステータスは異常となります |
| データ取り込み失敗率 | 90% 超 | 異常 | ログデータを収集し、Kodo-x からデータベースに書き込む際の失敗率が 90% を超えた場合、ログサービスのステータスは異常となります |
| メッセージサブスクリプション遅延 P99 | 5 分超 | 遅延 | アプリケーションパフォーマンスデータを収集し、メッセージキューから Kodo-x へのデータ遅延 P99 が 5 分を超えた場合、APM サービスのステータスは遅延となります |
サービスステータスの管理¶
サービスステータスページでは、以下の操作が可能です:
-
各サービスサイトのリンクをクリックして、対応するサービスステータスを切り替えて表示します;
-
サービスステータスをリアルタイムで更新します;
-
各 1 次機能モジュールの現在のステータスと過去 24 時間のステータスを表示します;
-
各サイトの過去 90 日間のサービスステータスと SLO 信頼性の結果を表示します;
-
過去のインシデントを切り替えて表示します。
サービス信頼性¶
Status Page は、各サイトの過去 90 日間のサービスステータスを表示し、SLO に基づいてサービス信頼性の結果を表示します。SLO(サービスレベル目標)は、指定された期間内にサービスが期待される可用性目標を達成しているかどうかを測定するために使用されます。SLO の結果を通じて、サービスが目標を達成しているかどうかを迅速に確認できます。
過去のインシデント¶
過去のインシデントページでは、以下の操作が可能です:
-
公開済みのサービスインシデントとメンテナンス記録を月別に表示します;
-
インシデントに関連する 1 次機能モジュールとその SLO 信頼性の結果を表示します;
-
切り替えてサービスステータスを表示します。
過去のインシデントは、所属サイトと業務日付に基づいて表示されます。インシデント記録に以下の情報が含まれている場合、ページにも表示されます:
-
インシデントステータス:異常、遅延、またはメンテナンス;
-
影響を受けるモジュール:1 つ以上の 1 次機能モジュール。
影響を受けるモジュールを含むインシデント記録は、対応する 1 次機能モジュールおよびその日の SLO 結果に関連付けられます。影響を受けるモジュールが指定されていない場合、その記録はサイトレベルの履歴記録として表示されます。
説明
Status Page には、Guance が公式に公開した内容のみが表示されます。下書き、アーカイブ済みのコンテンツ、および通常のワークスペース内の SLO、ノート、ナレッジコンテンツはここには表示されません。
