콘텐츠로 이동

인프라스트럭처


Guance는 애플리케이션 실행을 지원하는 모든 기본 컴퓨팅 리소스를 통합 모니터링합니다. 포함되는 항목은 다음과 같습니다(단, 이에 국한되지 않음):

  • 물리 머신 및 가상 머신
  • 컨테이너 및 Kubernetes 클러스터
  • 네트워크 장치 및 서비스
  • 다양한 클라우드 서비스

Guance는 DataKit을 통해 호스트, 컨테이너, 클라우드 서비스 등 인프라스트럭처의 메트릭, 로그, 객체 데이터를 통합 수집하고, 구성 요소 간의 동적 종속 관계를 자동으로 구축하여 시각화된 인프라스트럭처 토폴로지를 형성합니다. 이 토폴로지는 서비스, 컨테이너, 호스트 등 리소스의 실제 실행 위치와 연결 상태를 명확하게 보여주어, 사용자에게 전반적인 운영 인사이트부터 세부적인 수준의 인사이트까지 제공합니다.

통합된 태그 체계와 유연한 검색 기능을 기반으로, 플랫폼은 사용자가 목표 리소스를 신속하게 찾을 수 있도록 지원하며, 다양한 출처의 메트릭, 트레이스, 로그 데이터를 연관시킬 수 있습니다. 데이터 유형 간의 원활한 이동과 컨텍스트 연동을 통해 사용자는 문제의 근본 원인을 빠르게 추적하여 효율적인 장애 해결 및 성능 최적화를 실현할 수 있습니다.

기능

모듈 모니터링 대상 핵심 기능
호스트 물리 머신, 가상 머신, 클라우드 서버 200개 이상의 시스템 레벨 메트릭을 실시간 수집하며, CPU steal time, 메모리 swap activity, 디스크 IOPS 등 심층 성능 데이터를 포함
컨테이너 Docker, Kubernetes 핵심 리소스 클러스터 리소스 토폴로지 맵을 자동으로 구축하고, Pod 라이프사이클 상태 및 리소스 할당량 사용률을 실시간 모니터링
프로세스 호스트 실행 프로세스 프로세스 레벨 리소스 소비를 심층 모니터링하고, 프로세스와 비즈니스 간의 연관 관계를 구축
데이터베이스 MySQL, Redis, PostgreSQL 등 데이터베이스 성능 메트릭을 무중단 수집하고, QPS, 연결 수, 느린 쿼리 등을 실시간 모니터링
네트워크 호스트 및 컨테이너 네트워크 트래픽 eBPF 기술 기반으로 네트워크 트래픽을 무중단 수집하고, TCP 재전송, 연결 이상 등의 메트릭을 모니터링
리소스 카탈로그 클라우드 리소스, 사용자 정의 리소스 클라우드 공급업체 API를 자동으로 통합하고, RDS, 로드 밸런서 등 관리형 서비스를 통합 모니터링

사용 전제 조건

인프라스트럭처 모니터링을 사용하기 전에 다음 단계가 완료되었는지 확인하세요.

  1. Guance 워크스페이스에 등록 및 로그인합니다.
  2. 대상 호스트에 DataKit을 설치합니다.
  3. 모니터링 요구 사항에 따라 해당 수집기를 활성화합니다.

핵심 개념

객체(O): 객체는 인프라스트럭처의 엔터티 리소스(예: 호스트, 컨테이너, Pod, 프로세스)입니다. 객체 데이터는 리소스 속성, 상태 및 연관 관계를 포함하며, 이를 통해 리소스의 구성 정보와 운영 상태를 파악할 수 있습니다.

메트릭, 태그, 시계열 등 개념에 대한 자세한 설명은 메트릭을 참조하세요.

데이터 표시

인프라스트럭처 데이터는 탐색기를 통해 시각화되어 표시되며, 다음과 같은 분석 차원을 지원합니다.

  • 목록 보기: 객체의 실시간 상태를 표시하며, 정렬, 필터링, 사용자 정의 표시 열을 지원
  • 허니콤 차트: 리소스 클러스터의 동적 토폴로지 구조를 시각화하고, 계층 간 드릴다운을 지원
  • 상위 목록/파이 차트/트리맵: 그룹 기반 통계 데이터 분포 분석
  • 상세 페이지: 객체의 전체 속성, 메트릭 추세, 연관 데이터 및 바인딩된 뷰를 표시

시작하기

호스트 모니터링

200개 이상의 시스템 레벨 메트릭을 실시간 수집하며, CPU steal time, 메모리 swap activity, 디스크 IOPS 등 심층 성능 데이터를 포함합니다.

DataKit을 설치하면 시스템이 자동으로 여러 호스트 관련 수집기를 활성화하여 데이터를 워크스페이스에 자동으로 보고합니다.

기본적으로 활성화되는 수집기 목록은 다음과 같습니다.

수집기 이름 기능 설명
cpu 호스트 CPU 사용 현황
disk 디스크 점유율
diskio 호스트 디스크 IO 현황
mem 호스트 메모리 사용 현황
swap Swap 메모리 사용 현황
system 호스트 운영 체제 부하
net 호스트 네트워크 트래픽 현황
host_process 호스트 프로세스 목록 및 리소스 점유율 (기본적으로 10분 이상 실행 중인 프로세스 수집)
hostobject 호스트 기본 정보 (운영 체제, 하드웨어 정보 등)
container 호스트 컨테이너 또는 Kubernetes 데이터 (호스트에 컨테이너가 없으면 수집기가 자동으로 종료됨)

자세한 내용은 DataKit 수집기 사용, 호스트 객체를 참조하세요.

컨테이너 및 Kubernetes

클러스터 리소스 토폴로지 맵을 자동으로 구축하고, Pod 라이프사이클 상태 및 리소스 할당량 사용률을 실시간 모니터링하며, HPA(Horizontal Pod Autoscaler)의 탄력적 확장 효율을 정확하게 추적하고, 리소스 부족으로 인한 컨테이너 재시작 이벤트를 효과적으로 사전 경고합니다.

Guance는 컨테이너 데이터 수집을 활성화하는 두 가지 방법을 제공합니다.

  1. 호스트에 DataKit 설치: 컨테이너 수집기를 활성화하여 Containers 및 Pods 데이터 수집 지원
  2. DaemonSet 방식으로 DataKit 설치: Kubernetes 전체 리소스 데이터(Containers, Pods, Services, Deployments, Nodes 등) 수집을 지원하며, 클러스터 토폴로지를 자동으로 구축

프로세스 모니터링

프로세스 레벨 리소스 소비를 심층 모니터링하고, 프로세스와 비즈니스 간의 연관 관계를 구축하며, 이상 프로세스에서 해당 애플리케이션 성능 트레이스 및 로그 데이터로 빠르게 드릴다운하는 것을 지원합니다.

시스템은 기본적으로 프로세스 수집기를 활성화하여 최근 10분 이내의 프로세스 데이터를 수집합니다. 프로세스 메트릭 데이터(CPU, 메모리 등)를 수집하려면 DataKit 설치 디렉터리의 conf.d/host 폴더로 이동하여 host_processes.conf.sample을 복사하고 이름을 host_processes.conf로 변경한 후 open_metrictrue로 설정하고 DataKit을 재시작하세요.

수집기에 대한 자세한 내용은 프로세스를 참조하세요.

데이터베이스 모니터링

무중단 방식으로 주요 데이터베이스의 성능 메트릭을 자동 수집합니다. MySQL, Redis, PostgreSQL 등 일반적인 데이터베이스 유형을 망라하며, QPS, 연결 수, 느린 쿼리 등 핵심 성능 데이터를 실시간 모니터링합니다.

네트워크 모니터링

eBPF 기술을 기반으로 네트워크 트래픽을 무중단 수집하고, TCP 재전송, 연결 이상 등 네트워크 성능 메트릭을 종합적으로 모니터링하며, 실시간 토폴로지를 통해 서비스 종속 관계를 시각화합니다.

리소스 카탈로그

클라우드 공급업체 API를 자동으로 통합하고, RDS, 로드 밸런서 등 관리형 서비스를 통합 모니터링하며, 클라우드 공급업체 청구 데이터를 연동하여 비용과 성능을 이중으로 관리할 수 있습니다.

사용자 정의 리소스를 생성하고 DataKit API 및 DataFlux Func를 결합하여 클라우드 공급업체의 클라우드 리소스 데이터, 기업 비즈니스 데이터 등 모든 데이터를 Guance에 보고할 수 있습니다.

구체적인 작업 과정은 리소스 카탈로그 데이터 보고를 참조하세요.

연관 기능

  1. 모니터링: 인프라스트럭처 메트릭을 기반으로 인프라스트럭처 활성 상태 감지, 임계값 감지 등 모니터를 구성합니다.

  2. 메트릭: 인프라스트럭처 메저먼트 상세 정보를 확인하고, 메트릭 생성을 구성합니다.

  3. 로그: 호스트 및 컨테이너의 로그 데이터를 연관 분석합니다.

  4. 애플리케이션 성능 모니터링(APM): 인프라스트럭처에서 애플리케이션 분산 추적으로 드릴다운합니다.

문서 평가

이 페이지가 도움이 되었나요?