Status Page¶
Guance는 서비스 상태 페이지(Status Page)를 제공합니다. 이 페이지에서 각 사이트의 서비스 운영 상태, SLO 안정성 결과, 그리고 과거 장애 및 유지보수 기록을 확인할 수 있습니다.
당사는 모든 사이트의 서비스 상태를 지속적으로 모니터링합니다. 서비스 문제가 발생하면 팀이 즉시 대응하여 처리합니다. 사용 중 이상 현상이 발생하면 먼저 Guance의 서비스 상태를 확인하여 플랫폼 서비스의 일시적인 변동 때문인지 판단하는 것이 좋습니다. 예를 들어 로그 업로드 실패 시 먼저 Guance의 로그 서비스가 정상인지 확인할 수 있습니다.
서비스 사이트¶
네비게이션 바에서 도움말 > Status Page로 이동합니다.
구독 버튼을 클릭하면 해당 사이트의 서비스 운영 상태 모니터링을 시작할 수 있습니다. 구독 후 서비스에 이상이 발생하면 이메일 알림을 받게 됩니다.
참고
Guance는 사이트 내 워크스페이스의 각 기능을 지속적으로 모니터링합니다. 1분 간격으로 감지하고 5분마다 결과를 집계합니다. 5분 이내에 한 번이라도 이상이 감지되면 해당 주기를 이상으로 판정합니다. 특정 기능이 30분 연속(즉, 연속 6회 집계) 이상 상태이면 알림 메일이 트리거됩니다. 최초 알림 후 해당 기능의 다음 5분 집계 결과가 정상으로 복구되면 이상 이벤트가 종료된 것으로 판정합니다.
다음 링크를 클릭하여 Guance 각 사이트의 서비스 상태를 직접 확인할 수 있습니다.
| 사이트 | 로그인 URL | 클라우드 제공자 |
|---|---|---|
| 중국 1리전(항저우) | https://auth.guance.com/ | Alibaba Cloud(중국 항저우) |
| 중국 2리전(닝샤) | https://aws-auth.guance.com/ | AWS(중국 닝샤) |
| 중국 4리전(광저우) | https://cn4-auth.guance.com/ | Huawei Cloud(중국 광저우) |
| 중국 6리전(홍콩) | https://cn6-auth.guance.com/ | Alibaba Cloud(국제) |
| 미주 1리전(오레곤) | https://us1-auth.guance.com/ | AWS(미국 오레곤) |
| 아시아 태평양 1리전(싱가포르) | https://ap1-auth.guance.com/ | AWS(싱가포르) |
| 유럽 1리전(프랑크푸르트) | https://eu1-auth.guance.com/ | AWS(프랑크푸르트) |
| 인도네시아 1리전(자카르타) | https://id1-auth.guance.com/ | Tencent Cloud(자카르타) |
| 아프리카 1리전(남아프리카) | https://za1-auth.guance.com/ | Huawei Cloud(남아프리카) |
| 중동 1리전(아랍에미리트) | https://me1-auth.guance.com/ | AWS(아랍에미리트) |
서비스 상태¶
각 사이트 서비스는 다음과 같은 상태를 가질 수 있습니다.
| 서비스 상태 | 상태 설명 |
|---|---|
| 정상 | 현재 사이트의 서비스가 정상적으로 실행 중임을 나타냅니다. |
| 이상 | 현재 사이트의 서비스에 이상이 발생하여 데이터 업로드, 처리 또는 조회에 영향을 미칠 수 있습니다. |
| 지연 | 현재 사이트의 서비스를 계속 사용할 수 있지만 데이터 처리 또는 조회에 지연이 발생할 수 있습니다. |
| 유지보수 | Guance 기술 담당자가 관련 서비스를 유지보수 중입니다. |
이상/지연 판단 로직¶
Status Page에서는 이벤트, 인프라, 실제 사용자 모니터링(RUM), 애플리케이션 성능 모니터링(APM), 메트릭, 로그, 신서틱 모니터링, CI 가시성 등 주요 기능의 상태를 확인할 수 있습니다.
Status Page는 위의 데이터 처리 과정을 기반으로 데이터 처리 및 데이터 저장소 두 단계에서 서비스 상태를 판단합니다. 자세한 내용은 아래 표와 같습니다.
판단 항목 |
판단 조건 | 서비스 상태 | 예시 설명 |
|---|---|---|---|
| 데이터 전송 실패율 | 90% 초과 | 이상 | 로그 데이터 수집 시 Kodo에서 메시지 큐로 데이터를 전송하는 실패율이 90%를 초과하면 로그 서비스 상태가 이상이 됩니다. |
| 데이터 저장 실패율 | 90% 초과 | 이상 | 로그 데이터 수집 시 Kodo-x에서 데이터베이스로의 쓰기 실패율이 90%를 초과하면 로그 서비스 상태가 이상이 됩니다. |
| 메시지 구독 지연 P99 | 5분 초과 | 지연 | 애플리케이션 성능 데이터 수집 시 메시지 큐에서 Kodo-x로 전송되는 데이터의 지연 P99가 5분을 초과하면 애플리케이션 성능 모니터링(APM) 서비스 상태가 지연이 됩니다. |
서비스 상태 관리¶
서비스 상태 페이지에서는 다음 작업을 수행할 수 있습니다.
-
각 서비스 사이트 링크를 클릭하여 해당 서비스 상태를 전환하여 확인합니다.
-
서비스 상태를 실시간으로 새로고침합니다.
-
이벤트, 인프라, 실제 사용자 모니터링(RUM), 애플리케이션 성능 모니터링(APM), 메트릭, 로그, 신서틱 모니터링, CI 기능의 현재 상태 및 최근 24시간 상태를 확인합니다.
-
각 사이트의 최근 90일간 서비스 상태 및 SLO 안정성 결과를 확인합니다.
-
과거 장애를 전환하여 확인합니다.
서비스 안정성¶
Status Page는 각 사이트의 최근 90일간 서비스 상태를 표시하고 SLO를 기반으로 서비스 안정성 결과를 보여줍니다. SLO(서비스 수준 목표)는 지정된 시간 내에 서비스가 예상 가용성 목표에 도달했는지 측정하는 데 사용됩니다. SLO 결과를 통해 서비스가 목표를 달성했는지 빠르게 확인할 수 있습니다.
과거 장애¶
과거 장애 페이지에서는 다음 작업을 수행할 수 있습니다.
-
월별로 공개된 서비스 장애 및 유지보수 기록을 확인합니다.
-
장애와 관련된 SLO 안정성 결과를 확인합니다.
-
서비스 상태를 전환하여 확인합니다.
장애 기록에 다음 정보가 포함된 경우 페이지에 함께 표시됩니다.
-
장애 상태: 이상, 지연 또는 유지보수
-
영향을 받은 기능: 로그, 메트릭 또는 인프라
설명
Status Page에는 Guance 공식 발행 내용만 표시됩니다. 일반 워크스페이스의 SLO, 노트 및 지식 콘텐츠는 여기에 표시되지 않습니다.



