콘텐츠로 이동

Kubernetes 지능형 모니터링


지능형 탐지 알고리즘을 기반으로 총 Pod 수, Pod 재시작 횟수, API Server QPS 등의 핵심 지표를 정기적으로 모니터링함으로써 Kubernetes 지능형 탐지 기능은 클러스터에서 발생할 수 있는 문제를 신속하게 발견하고 예측할 수 있습니다. 이 접근 방식은 리소스 사용의 비정상적인 변동을 식별할 수 있을 뿐만 아니라 근본 원인 분석을 통해 설정 오류, 리소스 불일치, 과도한 요청 등 문제의 원인을 정확하게 짚어낼 수 있습니다. 이를 통해 Kubernetes 클러스터 운영 작업을 더욱 지능적이고 자동화된 방식으로 수행할 수 있습니다.

사용 사례

클러스터의 다양한 성능 지표를 심층적으로 파악하여 클러스터 리소스, 서비스 리소스에서 API server 계층까지 포괄적인 모니터링 기능을 제공합니다.

탐지 설정

  1. 모니터링 > 지능형 모니터링으로 이동하여 Kubernetes 지능형 모니터링을 새로 생성하고 선택합니다.
  2. 모니터 이름을 입력합니다.
  3. 탐지 조건을 조정하고 불필요한 규칙을 삭제합니다.
  4. 클러스터나 네임스페이스를 필터링해야 하는 경우 규칙의 탐지 쿼리(DQL)를 펼쳐 필터 조건을 수정합니다.
  5. 이벤트 알림, 알림 정책 및 작업 권한을 구성한 후 저장합니다.

이벤트 보기

모니터 목록에서 관련 이벤트 보기를 클릭하면 해당 모니터에서 발생한 이상 이벤트를 확인할 수 있습니다.

이벤트 상세 페이지

이벤트를 클릭하면 지능형 모니터링 이벤트의 상세 페이지를 확인할 수 있습니다. 이 페이지에는 이벤트 상태, 이상 발생 시간, 이상 이름, 분석 보고서, 알림, 기록 및 관련 이벤트가 포함됩니다.

  • 오른쪽 상단의 모니터로 이동을 클릭하면 지능형 모니터 설정을 확인하고 조정할 수 있습니다.

  • 오른쪽 상단의 내보내기 버튼을 클릭하면 "JSON 파일 내보내기" 및 "PDF 파일 내보내기"를 선택하여 현재 이벤트에 해당하는 모든 주요 데이터를 얻을 수 있습니다.

분석 보고서

  • 이상 요약: 현재 클러스터의 비정상 APIServer 노드 수 분포 통계를 표시합니다.

  • 이상 분석: APIServer 노드 수, API QPS, 처리 중인 읽기 요청 수, 쓰기 요청 성공률, 처리 중인 쓰기 요청 수 등의 정보를 확인할 수 있습니다.

확장 필드

알림

관련 이벤트

문서 평가

이 페이지가 도움이 되었나요?