화웨이 클라우드 검색 서비스 CSS for Elasticsearch
화웨이 클라우드 검색 서비스 CSS for Elasticsearch 모니터링 지표 수집
설정¶
Func 설치¶
추천: Guance 통합 - 확장 - 관리형 Func를 활성화하세요. 모든 사전 조건이 자동으로 설치되므로, 스크립트 설치를 계속 진행하면 됩니다
직접 Func를 배포하는 경우 Func 직접 배포를 참고하세요
스크립트 설치¶
참고: 요구 사항을 충족하는 화웨이 클라우드 AK를 미리 준비하세요. 간단하게 하려면 전역 읽기 전용 권한
Tenant Guest를 직접 부여해도 됩니다.
관리형 버전 활성화 스크립트¶
- Guance 콘솔에 로그인합니다
- 【통합】 메뉴를 클릭하고 【클라우드 계정 관리】를 선택합니다
- 【클라우드 계정 추가】를 클릭하고 【화웨이 클라우드】를 선택한 뒤, 화면에 필요한 정보를 입력합니다. 이전에 클라우드 계정 정보를 이미 구성했다면 이 단계는 건너뜁니다
- 【테스트】를 클릭하고, 테스트가 성공하면 【저장】을 클릭합니다. 테스트에 실패하면 관련 구성 정보가 올바른지 확인한 뒤 다시 테스트합니다
- 【클라우드 계정 관리】 목록에서 추가된 클라우드 계정을 확인할 수 있으며, 해당 클라우드 계정을 클릭하면 상세 페이지로 들어갈 수 있습니다
- 클라우드 계정 상세 페이지의 【통합】 버튼을 클릭한 뒤,
미설치목록에서화웨이 클라우드 검색 서비스 CSS for Elasticsearch를 찾아 【설치】 버튼을 클릭하면 설치 화면이 나타나며 설치할 수 있습니다
수동 활성화 스크립트¶
-
Func 콘솔에 로그인한 뒤 【스크립트 마켓】을 클릭하여 Guance 스크립트 마켓으로 들어가
integration_huaweicloud_css를 검색합니다 -
【설치】를 클릭한 뒤, 화웨이 클라우드 AK, SK 및 계정 이름 등 필요한 매개변수를 입력합니다
-
【배포 시작 스크립트】를 클릭하면 시스템이 자동으로
Startup스크립트 세트를 생성하고, 해당 시작 스크립트를 자동으로 구성합니다 -
활성화 후에는 「관리 / 자동 트리거 구성」에서 해당 자동 트리거 구성을 확인할 수 있습니다. 【실행】을 클릭하면 정기 실행을 기다리지 않고 즉시 한 번 실행할 수 있습니다. 잠시 후 실행 작업 기록과 해당 로그를 확인할 수 있습니다
검증¶
- 「관리 / 자동 트리거 구성」에서 해당 작업의 자동 트리거 구성이 존재하는지 확인하고, 동시에 작업 기록 및 로그를 확인하여 이상이 있는지 점검합니다
- Guance의 「인프라 - 리소스 디렉터리」에서 자산 정보가 있는지 확인합니다
- Guance의 「지표」에서 해당 모니터링 데이터가 있는지 확인합니다
지표¶
화웨이 클라우드 CSS 지표를 구성하면 설정 방식으로 더 많은 지표를 수집할 수 있습니다. 화웨이 클라우드 CSS 지표 상세
인스턴스 모니터링 지표¶
화웨이 클라우드 검색 서비스 CSS for Elasticsearch 인스턴스 성능 모니터링 지표는 아래 표와 같습니다. 더 많은 지표는 표 1을 참고하세요
| 지표 ID | 지표 이름 | 지표 의미 | 값 범위 | 모니터링 주기(원시 지표) |
|---|---|---|---|---|
status |
클러스터 상태 | 이 지표는 모니터링 대상의 상태를 집계하는 데 사용됩니다. | 0,1,2,3; 0:클러스터는 100% 사용 가능합니다. 1:데이터는 완전하지만 일부 복제본이 누락되었습니다. 고가용성이 어느 정도 약화되며 위험이 있으므로 클러스터 상태를 즉시 확인하세요. 2:데이터가 누락되어 클러스터 사용 시 이상이 발생합니다. 3:클러스터 상태를 가져오지 못했습니다. |
1분 |
indices_count |
인덱스 수 | CSS 클러스터의 인덱스 수입니다. | ≥ 0 | 1분 |
total_shards_count |
샤드 수 | CSS 클러스터의 샤드 수입니다. | ≥ 0 | 1분 |
primary_shards_count |
프라이머리 샤드 수 | CSS 클러스터의 프라이머리 샤드 수입니다. | ≥ 0 | 1분 |
coordinating_nodes_count |
코디네이팅 노드 수 | CSS 클러스터의 코디네이팅 노드 수입니다. | ≥ 0 | 1분 |
data_nodes_count |
데이터 노드 수 | CSS 클러스터의 데이터 노드 수입니다. | ≥ 0 | 1분 |
SearchRate |
평균 조회 속도 | 조회 QPS, 클러스터의 초당 평균 조회 작업 수입니다. | ≥ 0 | 1분 |
IndexingRate |
평균 인덱싱 속도 | 적재 TPS, 클러스터의 초당 평균 인덱싱 작업 수입니다. | ≥ 0 | 1분 |
IndexingLatency |
평균 인덱싱 지연 | 샤드가 인덱싱 작업을 완료하는 데 필요한 평균 시간입니다. | ≥ 0 ms | 1분 |
SearchLatency |
평균 조회 지연 | 샤드가 검색 작업을 완료하는 데 필요한 평균 시간입니다. | ≥ 0 ms | 1분 |
avg_cpu_usage |
평균 CPU 사용률 | CSS 클러스터의 각 노드 CPU 사용률 평균값입니다. | 0-100% | 1분 |
avg_mem_used_percent |
평균 사용 메모리 비율 | CSS 클러스터의 각 노드에서 사용 중인 메모리 비율의 평균값입니다. | 0-100% | 1분 |
disk_util |
디스크 사용률 | 이 지표는 모니터링 대상의 디스크 사용률을 집계하는 데 사용됩니다. | 0-100% | 1분 |
avg_load_average |
평균 노드 Load 값 | CSS 클러스터의 각 노드에서 운영체제의 1분 평균 대기 작업 수의 평균값입니다. | ≥ 0 | 1분 |
avg_jvm_heap_usage |
평균 JVM 힙 사용률 | CSS 클러스터의 각 노드 JVM 힙 메모리 사용률의 평균값입니다. | 0-100% | 1분 |
sum_current_opened_http_count |
현재 열려 있는 http 연결 수 | CSS 클러스터의 각 노드에서 열려 있고 아직 닫히지 않은 Http 연결 수의 합계입니다. | ≥ 0 | 1분 |
avg_thread_pool_write_queue |
Write 큐의 평균 대기 작업 수 | CSS 클러스터의 각 노드에서 쓰기 스레드 풀의 대기 작업 수 평균값입니다. | ≥ 0 | 1분 |
avg_thread_pool_search_queue |
Search 큐의 평균 대기 작업 수 | CSS 클러스터의 각 노드에서 검색 스레드 풀의 대기 작업 수 평균값입니다. | ≥ 0 | 1분 |
avg_thread_pool_force_merge_queue |
ForceMerge 큐의 평균 대기 작업 수 | CSS 클러스터의 각 노드에서 강제 병합 스레드 풀의 대기 작업 수 평균값입니다. | ≥ 0 | 1분 |
avg_thread_pool_write_rejected |
Write 큐의 평균 거부된 작업 수 | CSS 클러스터의 각 노드 쓰기 스레드 풀에서 거부된 작업 수의 평균값입니다. | ≥ 0 | 1분 |
avg_jvm_old_gc_count |
JVM Old 세대 평균 GC 횟수 | CSS 클러스터의 각 노드에서 “Old 세대” 가비지 수거 실행 횟수 누적값의 평균값입니다. | ≥ 0 | 1분 |
avg_jvm_old_gc_time |
JVM Old 세대 평균 GC 시간 | CSS 클러스터의 각 노드에서 “Old 세대” 가비지 수거를 수행하는 데 걸린 시간 누적값의 평균값입니다. | ≥ 0 ms | 1분 |
avg_jvm_young_gc_count |
JVM Young 세대 평균 GC 횟수 | CSS 클러스터의 각 노드에서 “Young 세대” 가비지 수거 실행 횟수 누적값의 평균값입니다. | ≥ 0 | 1분 |
avg_jvm_young_gc_time |
JVM Young 세대 평균 GC 시간 | CSS 클러스터의 각 노드에서 “Young 세대” 가비지 수거를 수행하는 데 걸린 시간 누적값의 평균값입니다. | ≥ 0 ms | 1분 |
객체¶
수집된 화웨이 클라우드 검색 서비스 CSS for Elasticsearch 객체 데이터 구조는 「인프라 - 리소스 디렉터리」에서 확인할 수 있습니다
{
"measurement": "huaweicloud_css",
"tags": {
"RegionId" : "cn-north-4",
"project_id" : "xxxxxxx",
"enterpriseProjectId" : "",
"instance_id" : "xxxxxxx-xxxxxxx-xxxxxxx-00001",
"instance_name" : "css-3384",
"publicIp" : "xxxxx",
"status" : "100",
"endpoint" : "192.168.0.100:9200",
},
"fields": {
"vpc_id" : "3dda7d4b-aec0-4838-a91a-28xxxxxxxx",
"subnetId" : "xxxxx",
"securityGroupId" : "xxxxxxx",
"datastore" : "{\"supportSecuritymode\": false, \"type\": \"elasticsearch\", \"version\": \"7.6.2\"}",
"instances" : "[{\"azCode\": \"cn-east-3a\", \"id\": \"95f61e90-507b-48d4-8ac5-53dcefd155a3\", \"ip\": \"192.168.0.140\", \"name\": \"css-test-ess-esn-1-1\", \"specCode\": \"ess.spec-kc1.xlarge.2\", \"status\": \"200\", \"type\": \"ess\", \"volume\": {\"size\": 40, \"type\": \"HIGH\"}}]",
"publicKibanaResp" : "xxxx",
"elbWhiteList" : "xxxx",
"updated" : "2023-06-27T07:35:29",
"created" : "2023-06-27T07:35:29",
"bandwidthSize" : "100",
"actions" : "REBOOTING",
"tags" : "xxxx",
"period" : true,
}
}
일부 매개변수 설명은 다음과 같습니다:
| 매개변수명 | 설명 |
|---|---|
status |
클러스터 상태 값 |
updated |
클러스터의 마지막 수정 시간, 형식은 ISO8601입니다 |
bandwidthSize |
공인망 대역폭, 단위: Mbit/s |
actions |
클러스터의 현재 동작 |
period |
패키지 기간제 클러스터인지 여부 |
status(클러스터 상태 값)의 값 의미:
| 값 | 설명 |
|---|---|
100 |
생성 중 |
200 |
사용 가능 |
303 |
사용 불가 |
actions(클러스터의 현재 동작)의 값 의미:
| 값 | 설명 |
|---|---|
REBOOTING |
재시작 |
GROWING |
확장 |
RESTORING |
클러스터 복구 |
SNAPSHOTTING |
스냅샷 생성 |
period 값 의미:
| 값 | 설명 |
|---|---|
true |
패키지 기간제 과금 클러스터 |
false |
종량제 과금 클러스터 |
주의:
tags,fields의 필드는 후속 업데이트에 따라 변경될 수 있습니다팁:
tags.instance_id값은 클러스터 ID이며, 고유 식별자로 사용됩니다