콘텐츠로 이동

화웨이 클라우드 검색 서비스 CSS for Elasticsearch

화웨이 클라우드 검색 서비스 CSS for Elasticsearch 모니터링 지표 수집

설정

Func 설치

추천: Guance 통합 - 확장 - 관리형 Func를 활성화하세요. 모든 사전 조건이 자동으로 설치되므로, 스크립트 설치를 계속 진행하면 됩니다

직접 Func를 배포하는 경우 Func 직접 배포를 참고하세요

스크립트 설치

참고: 요구 사항을 충족하는 화웨이 클라우드 AK를 미리 준비하세요. 간단하게 하려면 전역 읽기 전용 권한 Tenant Guest를 직접 부여해도 됩니다.

관리형 버전 활성화 스크립트

  1. Guance 콘솔에 로그인합니다
  2. 【통합】 메뉴를 클릭하고 【클라우드 계정 관리】를 선택합니다
  3. 【클라우드 계정 추가】를 클릭하고 【화웨이 클라우드】를 선택한 뒤, 화면에 필요한 정보를 입력합니다. 이전에 클라우드 계정 정보를 이미 구성했다면 이 단계는 건너뜁니다
  4. 【테스트】를 클릭하고, 테스트가 성공하면 【저장】을 클릭합니다. 테스트에 실패하면 관련 구성 정보가 올바른지 확인한 뒤 다시 테스트합니다
  5. 【클라우드 계정 관리】 목록에서 추가된 클라우드 계정을 확인할 수 있으며, 해당 클라우드 계정을 클릭하면 상세 페이지로 들어갈 수 있습니다
  6. 클라우드 계정 상세 페이지의 【통합】 버튼을 클릭한 뒤, 미설치 목록에서 화웨이 클라우드 검색 서비스 CSS for Elasticsearch를 찾아 【설치】 버튼을 클릭하면 설치 화면이 나타나며 설치할 수 있습니다

수동 활성화 스크립트

  1. Func 콘솔에 로그인한 뒤 【스크립트 마켓】을 클릭하여 Guance 스크립트 마켓으로 들어가 integration_huaweicloud_css를 검색합니다

  2. 【설치】를 클릭한 뒤, 화웨이 클라우드 AK, SK 및 계정 이름 등 필요한 매개변수를 입력합니다

  3. 【배포 시작 스크립트】를 클릭하면 시스템이 자동으로 Startup 스크립트 세트를 생성하고, 해당 시작 스크립트를 자동으로 구성합니다

  4. 활성화 후에는 「관리 / 자동 트리거 구성」에서 해당 자동 트리거 구성을 확인할 수 있습니다. 【실행】을 클릭하면 정기 실행을 기다리지 않고 즉시 한 번 실행할 수 있습니다. 잠시 후 실행 작업 기록과 해당 로그를 확인할 수 있습니다

검증

  1. 「관리 / 자동 트리거 구성」에서 해당 작업의 자동 트리거 구성이 존재하는지 확인하고, 동시에 작업 기록 및 로그를 확인하여 이상이 있는지 점검합니다
  2. Guance의 「인프라 - 리소스 디렉터리」에서 자산 정보가 있는지 확인합니다
  3. Guance의 「지표」에서 해당 모니터링 데이터가 있는지 확인합니다

지표

화웨이 클라우드 CSS 지표를 구성하면 설정 방식으로 더 많은 지표를 수집할 수 있습니다. 화웨이 클라우드 CSS 지표 상세

인스턴스 모니터링 지표

화웨이 클라우드 검색 서비스 CSS for Elasticsearch 인스턴스 성능 모니터링 지표는 아래 표와 같습니다. 더 많은 지표는 표 1을 참고하세요

지표 ID 지표 이름 지표 의미 값 범위 모니터링 주기(원시 지표)
status 클러스터 상태 이 지표는 모니터링 대상의 상태를 집계하는 데 사용됩니다. 0,1,2,3;
0:클러스터는 100% 사용 가능합니다.
1:데이터는 완전하지만 일부 복제본이 누락되었습니다. 고가용성이 어느 정도 약화되며 위험이 있으므로 클러스터 상태를 즉시 확인하세요.
2:데이터가 누락되어 클러스터 사용 시 이상이 발생합니다.
3:클러스터 상태를 가져오지 못했습니다.
1분
indices_count 인덱스 수 CSS 클러스터의 인덱스 수입니다. ≥ 0 1분
total_shards_count 샤드 수 CSS 클러스터의 샤드 수입니다. ≥ 0 1분
primary_shards_count 프라이머리 샤드 수 CSS 클러스터의 프라이머리 샤드 수입니다. ≥ 0 1분
coordinating_nodes_count 코디네이팅 노드 수 CSS 클러스터의 코디네이팅 노드 수입니다. ≥ 0 1분
data_nodes_count 데이터 노드 수 CSS 클러스터의 데이터 노드 수입니다. ≥ 0 1분
SearchRate 평균 조회 속도 조회 QPS, 클러스터의 초당 평균 조회 작업 수입니다. ≥ 0 1분
IndexingRate 평균 인덱싱 속도 적재 TPS, 클러스터의 초당 평균 인덱싱 작업 수입니다. ≥ 0 1분
IndexingLatency 평균 인덱싱 지연 샤드가 인덱싱 작업을 완료하는 데 필요한 평균 시간입니다. ≥ 0 ms 1분
SearchLatency 평균 조회 지연 샤드가 검색 작업을 완료하는 데 필요한 평균 시간입니다. ≥ 0 ms 1분
avg_cpu_usage 평균 CPU 사용률 CSS 클러스터의 각 노드 CPU 사용률 평균값입니다. 0-100% 1분
avg_mem_used_percent 평균 사용 메모리 비율 CSS 클러스터의 각 노드에서 사용 중인 메모리 비율의 평균값입니다. 0-100% 1분
disk_util 디스크 사용률 이 지표는 모니터링 대상의 디스크 사용률을 집계하는 데 사용됩니다. 0-100% 1분
avg_load_average 평균 노드 Load 값 CSS 클러스터의 각 노드에서 운영체제의 1분 평균 대기 작업 수의 평균값입니다. ≥ 0 1분
avg_jvm_heap_usage 평균 JVM 힙 사용률 CSS 클러스터의 각 노드 JVM 힙 메모리 사용률의 평균값입니다. 0-100% 1분
sum_current_opened_http_count 현재 열려 있는 http 연결 수 CSS 클러스터의 각 노드에서 열려 있고 아직 닫히지 않은 Http 연결 수의 합계입니다. ≥ 0 1분
avg_thread_pool_write_queue Write 큐의 평균 대기 작업 수 CSS 클러스터의 각 노드에서 쓰기 스레드 풀의 대기 작업 수 평균값입니다. ≥ 0 1분
avg_thread_pool_search_queue Search 큐의 평균 대기 작업 수 CSS 클러스터의 각 노드에서 검색 스레드 풀의 대기 작업 수 평균값입니다. ≥ 0 1분
avg_thread_pool_force_merge_queue ForceMerge 큐의 평균 대기 작업 수 CSS 클러스터의 각 노드에서 강제 병합 스레드 풀의 대기 작업 수 평균값입니다. ≥ 0 1분
avg_thread_pool_write_rejected Write 큐의 평균 거부된 작업 수 CSS 클러스터의 각 노드 쓰기 스레드 풀에서 거부된 작업 수의 평균값입니다. ≥ 0 1분
avg_jvm_old_gc_count JVM Old 세대 평균 GC 횟수 CSS 클러스터의 각 노드에서 “Old 세대” 가비지 수거 실행 횟수 누적값의 평균값입니다. ≥ 0 1분
avg_jvm_old_gc_time JVM Old 세대 평균 GC 시간 CSS 클러스터의 각 노드에서 “Old 세대” 가비지 수거를 수행하는 데 걸린 시간 누적값의 평균값입니다. ≥ 0 ms 1분
avg_jvm_young_gc_count JVM Young 세대 평균 GC 횟수 CSS 클러스터의 각 노드에서 “Young 세대” 가비지 수거 실행 횟수 누적값의 평균값입니다. ≥ 0 1분
avg_jvm_young_gc_time JVM Young 세대 평균 GC 시간 CSS 클러스터의 각 노드에서 “Young 세대” 가비지 수거를 수행하는 데 걸린 시간 누적값의 평균값입니다. ≥ 0 ms 1분

객체

수집된 화웨이 클라우드 검색 서비스 CSS for Elasticsearch 객체 데이터 구조는 「인프라 - 리소스 디렉터리」에서 확인할 수 있습니다

{
  "measurement": "huaweicloud_css",
  "tags": {
    "RegionId"                   : "cn-north-4",
    "project_id"                 : "xxxxxxx",
    "enterpriseProjectId"        : "",
    "instance_id"                : "xxxxxxx-xxxxxxx-xxxxxxx-00001",
    "instance_name"              : "css-3384",
    "publicIp"                   : "xxxxx",
    "status"                     : "100",
    "endpoint"                   : "192.168.0.100:9200",
  },
  "fields": {
    "vpc_id"                     : "3dda7d4b-aec0-4838-a91a-28xxxxxxxx",
    "subnetId"                   : "xxxxx",
    "securityGroupId"            : "xxxxxxx",
    "datastore"                           : "{\"supportSecuritymode\": false, \"type\": \"elasticsearch\", \"version\": \"7.6.2\"}",
    "instances"                           : "[{\"azCode\": \"cn-east-3a\", \"id\": \"95f61e90-507b-48d4-8ac5-53dcefd155a3\", \"ip\": \"192.168.0.140\", \"name\": \"css-test-ess-esn-1-1\", \"specCode\": \"ess.spec-kc1.xlarge.2\", \"status\": \"200\", \"type\": \"ess\", \"volume\": {\"size\": 40, \"type\": \"HIGH\"}}]",
    "publicKibanaResp"                    : "xxxx",
    "elbWhiteList"                        : "xxxx",
    "updated"                             : "2023-06-27T07:35:29",
    "created"                             : "2023-06-27T07:35:29",
    "bandwidthSize"                       : "100",
    "actions"                             : "REBOOTING",
    "tags"                                : "xxxx",
    "period"                              : true, 
  }
}

일부 매개변수 설명은 다음과 같습니다:

매개변수명 설명
status 클러스터 상태 값
updated 클러스터의 마지막 수정 시간, 형식은 ISO8601입니다
bandwidthSize 공인망 대역폭, 단위: Mbit/s
actions 클러스터의 현재 동작
period 패키지 기간제 클러스터인지 여부

status(클러스터 상태 값)의 값 의미:

설명
100 생성 중
200 사용 가능
303 사용 불가

actions(클러스터의 현재 동작)의 값 의미:

설명
REBOOTING 재시작
GROWING 확장
RESTORING 클러스터 복구
SNAPSHOTTING 스냅샷 생성

period 값 의미:

설명
true 패키지 기간제 과금 클러스터
false 종량제 과금 클러스터

주의: tags, fields의 필드는 후속 업데이트에 따라 변경될 수 있습니다

팁: tags.instance_id 값은 클러스터 ID이며, 고유 식별자로 사용됩니다

문서 평가

이 페이지가 도움이 되었나요?