네트워크 데이터 모니터링¶
현재 문서의 위치
이 문서는 모니터링 규칙 설정 프로세스의 두 번째 단계입니다. 설정을 완료한 후에는 기본 문서로 돌아가 세 번째 단계: 이벤트 알림을 계속 진행하세요.
워크스페이스 내 네트워크 성능 지표를 모니터링하는 데 사용됩니다. 사용자가 임계값 범위를 설정할 수 있으며, 지표가 이 임계값을 초과하면 알림이 트리거됩니다. 단일 지표에 대한 알림 규칙 설정을 지원하며, 알림 심각도 수준을 사용자 정의할 수 있습니다.
데이터 범위: 데이터 소스가 netflow, httpflow인 지표 데이터를 지원합니다.
네트워크 계층의 주요 성능 지표를 모니터링하는 데 적합합니다. 예:
- 호스트에서 데이터 소스가
netflow인 TCP 연결 수, 재전송 횟수, 지연 시간 등의 네트워크 계층 지표 모니터링 - 데이터 소스가
httpflow인 요청 수, 오류 수, 오류율, 응답 시간 등의 애플리케이션 계층 지표 모니터링
모니터링 설정¶
모니터링 빈도¶
모니터링을 실행할 시간 주기를 설정합니다.
-
사전 설정 옵션: 1분, 5분(기본값), 15분, 30분, 1시간, 6시간, 12시간, 24시간
-
Crontab 모드: "Crontab 모드로 전환"을 클릭하여 사용자 정의 주기를 설정할 수 있습니다. 초, 분, 시간, 일, 월, 주 등의 주기를 기반으로 예약된 작업 실행을 설정하는 것을 지원합니다.
모니터링 범위¶
각 모니터링에서 쿼리할 데이터 시간 범위를 설정합니다(❗️모니터링 범위는 모니터링 빈도보다 크거나 같아야 하며, 데이터 실제 보고 주기와 일치해야 합니다. 그렇지 않으면 누락 또는 잘못된 보고가 발생할 수 있습니다).
| 모니터링 빈도 | 모니터링 범위 (드롭다운 선택 가능) |
|---|---|
| 30초 | 1분/5분/15분/30분/1시간/3시간 |
| 1분 | 1분/5분/15분/30분/1시간/3시간 |
| 5분 | 5분/15분/30분/1시간/3시간 |
| 15분 | 15분/30분/1시간/3시간/6시간 |
| 30분 | 30분/1시간/3시간/6시간 |
| 1시간 | 1시간/3시간/6시간/12시간/24시간 |
| 6시간 | 6시간/12시간/24시간 |
| 12시간 | 12시간/24시간 |
| 24시간 | 24시간 |
- 사용자 정의 형식: 모니터링 범위를 직접 입력할 수 있습니다. 예:
20m(최근 20분),2h(최근 2시간),1d(최근 1일)
모니터링 지표¶
모니터링할 데이터의 지표를 설정합니다. 워크스페이스 내 전체 또는 단일 서비스 목록에서 특정 시간 범위의 지표 데이터를 설정하는 것을 지원합니다(❗️모니터링 차원으로 높은 카디널리티(High Cardinality) 필드를 선택하지 마십시오. 설정이 부적절하고 트리거 조건이 너무 느슨하면 빈번한 알림이 발생할 수 있습니다. 현재 쿼리 최대 반환 수는 10만 개 레코드입니다).
설정 요소¶
| 설정 항목 | 설명 |
|---|---|
| 데이터 소스 | 지원 선택: • netflow: 네트워크 트래픽 데이터(TCP 계층 지표)• httpflow: HTTP 트래픽 데이터(애플리케이션 계층 지표) |
| 지표 | 선택한 데이터 소스에 따라 해당 지표가 표시됩니다: netflow 지표: • 전송 바이트 수 • 수신 바이트 수 • TCP 지연 시간 • TCP 지터 • TCP 연결 횟수 • TCP 재전송 횟수 • TCP 연결 종료 횟수 httpflow 지표: • 요청 수 • 오류 수 • 오류율 • 평균 응답 시간 • P99 응답 시간 • P95 응답 시간 • P75 응답 시간 • P50 응답 시간 |
| 필터 조건 | 지표의 태그를 기반으로 모니터링 지표 데이터를 필터링하여 모니터링 데이터 범위를 제한합니다. 하나 이상의 태그 필터를 추가하는 것을 지원합니다. 와일드카드 일치 및 와일드카드 불일치 필터 조건을 지원합니다 |
| 모니터링 차원 | 데이터에서 해당하는 문자열 타입(keyword) 필드는 모두 모니터링 차원으로 선택할 수 있습니다. 현재 모니터링 차원은 최대 3개의 필드를 지원합니다. 여러 모니터링 차원의 필드 조합을 통해 특정 모니터링 대상을 결정할 수 있으며, 시스템은 각 모니터링 대상의 통계 지표가 트리거 조건의 임계값을 충족하는지 판단하고, 조건이 충족되면 이벤트를 생성합니다.* (예: 모니터링 차원 host와 host_ip를 선택하면 모니터링 대상은 {host: host1, host_ip: 127.0.0.1}이 될 수 있습니다.) |
트리거 조건¶
트리거 조건 및 심각도를 설정합니다. 쿼리 결과가 여러 값인 경우, 하나의 값이라도 트리거 조건을 충족하면 이벤트가 생성됩니다.
치명적, 심각, 중요, 경고의 4단계 임계값과 정상 복구 조건을 설정할 수 있습니다.
| 등급 | 설정 | 설명 |
|---|---|---|
| 치명적 | 결과 >= [값] |
최고 등급 알림, 즉시 처리 필요 |
| 심각 | 결과 >= [값] |
높은 등급 알림, 우선 처리 필요 |
| 중요 | 결과 >= [값] |
중간 등급 알림, 주의 필요 |
| 경고 | 결과 >= [값] |
낮은 등급 알림, 확인 필요 |
| 정상 | [N]회 모니터링에서 이벤트 미발생 |
모니터링 규칙이 적용된 후, 설정된 사용자 정의 모니터링 횟수 내에 데이터 모니터링 결과가 비정상(치명적, 심각, 중요, 경고)에서 정상으로 복구되면 복구 알림 이벤트가 트리거됩니다. ❗️ 복구 알림 이벤트는 알림 음소거의 제한을 받지 않습니다. 복구 알림 이벤트 모니터링 횟수가 설정되지 않은 경우, 알림 이벤트는 복구되지 않으며 계속 이벤트 > 미복구 이벤트 목록에 표시됩니다. |
자세한 내용은 이벤트 등급 설명을 참조하세요.
고급 옵션¶
연속 트리거 판단¶
활성화하면, 트리거 조건이 지속적으로 충족될 때만 이벤트가 생성되어 일시적인 변동으로 인한 오탐지를 방지합니다(❗️최대 설정 상한은 10회입니다).
대량 알림 보호¶
시스템에서 기본적으로 활성화됩니다.
단일 모니터링에서 생성된 알림 수가 사전 설정된 임계값을 초과하면, 시스템이 자동으로 상태별 요약 전략으로 전환합니다: 더 이상 알림 대상을 개별적으로 처리하지 않고, 이벤트 상태를 기반으로 소수의 요약 알림을 생성하여 푸시합니다.
이를 통해 알림의 적시성을 보장하면서도 알림 노이즈를 크게 줄이고, 과도한 알림 처리로 인한 타임아웃 위험을 방지할 수 있습니다.
이 스위치가 활성화되면, 이후 모니터가 이상을 감지하여 생성한 이벤트 상세에는 기록 기록 및 관련 이벤트가 표시되지 않습니다.
데이터 중단¶
모니터링 범위 내에서 모니터링 지표의 쿼리 결과가 비어 있을 때의 처리 전략입니다:
| 옵션 | 설명 |
|---|---|
| 이벤트 트리거 안 함 (기본값) | 모니터링 범위의 시간 범위와 연동하여, 최근 몇 분 동안의 모니터링 지표 쿼리 결과를 기반으로 이벤트 생성 여부를 판단합니다. 데이터 누락이 허용되는 시나리오에 적합합니다 |
| 쿼리 결과를 0으로 간주 | 모니터링 범위의 시간 범위와 연동하여, 최근 몇 분 동안의 모니터링 지표 쿼리 결과를 0으로 간주하고, 위의 트리거 조건에 설정된 임계값과 다시 비교하여 이상 이벤트 트리거 여부를 판단합니다 |
| 사용자 정의 값 채우기 및 이벤트 트리거 | 사용자 정의 모니터링 범위 값을 채우고, 다음 이벤트 유형을 각각 트리거하는 것을 지원합니다: 데이터 중단 이벤트, 치명적 이벤트, 심각 이벤트, 중요 이벤트, 경고 이벤트 및 복구 이벤트. ❗️이 전략을 선택할 때는 사용자 정의 데이터 중단 시간 설정이 모니터링 범위의 시간 간격 ≥ 이 되도록 권장합니다. 설정 시간이 모니터링 범위 시간 간격 ≤ 인 경우, 데이터 중단과 이상이 동시에 충족될 수 있으며, 이 경우 데이터 중단 처리 결과가 우선 적용됩니다. |
트리거 조건, 데이터 중단, 정보 생성이 동시에 설정된 경우, 다음 우선순위에 따라 트리거가 판단됩니다: 데이터 중단 > 트리거 조건 > 정보 이벤트 생성.
즉, 먼저 데이터 중단인지 판단하고, 그 다음 임계값 트리거 여부를 판단하며, 마지막으로 정보 이벤트 생성 여부를 판단합니다.
정보 생성¶
이 옵션을 활성화하면 정보 생성 조건을 설정해야 합니다. 모니터링 결과가 "치명적", "심각", "중요", "경고" 임계값 중 어느 하나도 트리거하지 않고, 정보 생성 조건을 충족하는 경우에만 시스템이 "정보" 이벤트를 기록합니다.
정상 상태 변경이나 낮은 우선순위 정보를 기록해야 하는 시나리오에 적합합니다.
후속 설정¶
위의 모니터링 설정을 완료한 후, 다음 설정을 계속 진행하세요: