Kubernetes 지능형 점검¶
지능형 점검 알고리즘을 기반으로 Pod 총 개수, Pod 재시작 횟수, API Server QPS 등 주요 지표를 정기적으로 모니터링하여 Kubernetes 지능형 점검은 클러스터에서 발생할 수 있는 문제를 조기에 감지하고 예측합니다. 이 방법은 리소스 사용량의 비정상적인 변동을 식별할 수 있을 뿐만 아니라, 근본 원인 분석을 통해 설정 오류, 리소스 불일치 또는 과도한 요청 등 문제의 정확한 원인을 파악합니다. 이를 통해 Kubernetes 클러스터의 운영 작업을 더욱 지능적이고 자동화할 수 있습니다.
사용 사례¶
클러스터의 다양한 성능 지표를 심층적으로 분석하여 클러스터 리소스, 서비스 리소스, API 서버 수준에서 포괄적인 모니터링 기능을 제공합니다.
탐지 구성¶
- 모니터 이름을 정의합니다.
- 탐지 범위를 선택합니다. 클러스터, 네임스페이스, 호스트를 기준으로 필터링하여 탐지 데이터 범위를 제한합니다. 하나 이상의 태그를 추가할 수 있습니다. 필터를 추가하지 않으면 모든 지표 데이터를 탐지합니다.
이벤트 확인¶
모니터는 최근 10분간의 애플리케이션 서비스 객체 지표 정보를 수집합니다. 이상 상황이 감지되면 해당 이벤트가 생성되며, 이벤트 > 지능형 모니터링 목록에서 해당 이상 이벤트를 확인할 수 있습니다.
이벤트 상세 페이지¶
이벤트를 클릭하면 지능형 모니터링 이벤트의 상세 페이지를 확인할 수 있습니다. 여기에는 이벤트 상태, 이상 발생 시간, 이상 이름, 분석 보고서, 알림, 기록 및 관련 이벤트가 포함됩니다.
- 오른쪽 상단의 모니터로 이동을 클릭하면 지능형 모니터링 구성을 확인하고 조정할 수 있습니다.
- 오른쪽 상단의 내보내기 버튼을 클릭하면 "JSON 파일로 내보내기"와 "PDF 파일로 내보내기"를 선택하여 현재 이벤트의 모든 주요 데이터를 가져올 수 있습니다.
분석 보고서
- 이상 요약: 현재 클러스터의 이상 APIServer 노드 수 분포 통계를 표시합니다.
- 이상 분석: APIServer 노드 수, API QPS, 읽기 요청 처리 중인 요청 수, 쓰기 요청 성공률, 쓰기 요청 처리 중인 요청 수 등의 정보를 확인할 수 있습니다.
