Kubernetes 지능형 모니터링¶
지능형 탐지 알고리즘을 기반으로 총 Pod 수, Pod 재시작 횟수, API Server QPS 등의 핵심 지표를 정기적으로 모니터링함으로써 Kubernetes 지능형 탐지 기능은 클러스터에서 발생할 수 있는 문제를 신속하게 발견하고 예측할 수 있습니다. 이 접근 방식은 리소스 사용의 비정상적인 변동을 식별할 수 있을 뿐만 아니라 근본 원인 분석을 통해 설정 오류, 리소스 불일치, 과도한 요청 등 문제의 원인을 정확하게 짚어낼 수 있습니다. 이를 통해 Kubernetes 클러스터 운영 작업을 더욱 지능적이고 자동화된 방식으로 수행할 수 있습니다.
사용 사례¶
클러스터의 다양한 성능 지표를 심층적으로 파악하여 클러스터 리소스, 서비스 리소스에서 API server 계층까지 포괄적인 모니터링 기능을 제공합니다.
탐지 설정¶
- 모니터링 > 지능형 모니터링으로 이동하여 Kubernetes 지능형 모니터링을 새로 생성하고 선택합니다.
- 모니터 이름을 입력합니다.
- 탐지 조건을 조정하고 불필요한 규칙을 삭제합니다.
- 클러스터나 네임스페이스를 필터링해야 하는 경우 규칙의 탐지 쿼리(DQL)를 펼쳐 필터 조건을 수정합니다.
- 이벤트 알림, 알림 정책 및 작업 권한을 구성한 후 저장합니다.
이벤트 보기¶
모니터 목록에서 관련 이벤트 보기를 클릭하면 해당 모니터에서 발생한 이상 이벤트를 확인할 수 있습니다.
이벤트 상세 페이지¶
이벤트를 클릭하면 지능형 모니터링 이벤트의 상세 페이지를 확인할 수 있습니다. 이 페이지에는 이벤트 상태, 이상 발생 시간, 이상 이름, 분석 보고서, 알림, 기록 및 관련 이벤트가 포함됩니다.
-
오른쪽 상단의 모니터로 이동을 클릭하면 지능형 모니터 설정을 확인하고 조정할 수 있습니다.
-
오른쪽 상단의 내보내기 버튼을 클릭하면 "JSON 파일 내보내기" 및 "PDF 파일 내보내기"를 선택하여 현재 이벤트에 해당하는 모든 주요 데이터를 얻을 수 있습니다.
분석 보고서
-
이상 요약: 현재 클러스터의 비정상 APIServer 노드 수 분포 통계를 표시합니다.
-
이상 분석: APIServer 노드 수, API QPS, 처리 중인 읽기 요청 수, 쓰기 요청 성공률, 처리 중인 쓰기 요청 수 등의 정보를 확인할 수 있습니다.