콘텐츠로 이동

AWS MSK

Amazon Managed Streaming for Apache Kafka(Amazon MSK)는 Apache Kafka를 사용해 스트리밍 데이터를 처리하는 애플리케이션을 구축하고 실행할 수 있게 해 주는 완전 관리형 서비스입니다.

스크립트 마켓의 “Guance 클라우드 동기화” 시리즈 스크립트 패키지를 사용해 클라우드 모니터링 및 클라우드 자산 데이터를 Guance로 동기화

설정

Func 설치

Guance 통합 - 확장 - 관리형 Func 활성화를 권장합니다. 사전 조건은 모두 자동으로 설치되므로, 스크립트 설치를 계속 진행하세요.

Func를 직접 배포하는 경우 Func 직접 배포를 참고하세요

스크립트 설치

안내: 요구 사항을 충족하는 Amazon AK를 미리 준비하세요. (간단히 하려면 전역 읽기 전용 권한 ReadOnlyAccess를 직접 부여해도 됩니다)

관리형 버전 스크립트 활성화

  1. Guance 콘솔에 로그인
  2. [통합] 메뉴를 클릭하고 [클라우드 계정 관리]를 선택
  3. [클라우드 계정 추가]를 클릭하고 [AWS]를 선택한 뒤 화면에 필요한 정보를 입력합니다. 이전에 클라우드 계정 정보를 이미 설정했다면 이 단계는 건너뜁니다.
  4. [테스트]를 클릭합니다. 테스트가 성공하면 [저장]을 클릭하세요. 테스트가 실패하면 관련 설정이 올바른지 확인한 뒤 다시 테스트하세요.
  5. [클라우드 계정 관리] 목록에서 추가된 클라우드 계정을 확인할 수 있습니다. 해당 클라우드 계정을 클릭해 상세 페이지로 들어갑니다.
  6. 클라우드 계정 상세 페이지의 [통합] 버튼을 클릭한 뒤 설치 안 됨 목록에서 AWS MSK를 찾아 [설치] 버튼을 클릭하고, 설치 화면에서 설치하면 됩니다.

수동 활성화 스크립트

  1. Func 콘솔에 로그인한 뒤 [스크립트 마켓]을 클릭하여 Guance 스크립트 마켓으로 들어가 integration_aws_kafka를 검색합니다.

  2. [설치]를 클릭한 뒤 AWS AK ID, AK Secret 및 계정명을 입력합니다.

  3. [배포 시작 스크립트]를 클릭하면 시스템이 자동으로 Startup 스크립트 세트를 생성하고, 해당 시작 스크립트를 자동으로 구성합니다.

  4. 활성화 후에는 “관리 / 자동 트리거 설정”에서 해당 자동 트리거 설정을 확인할 수 있습니다. [실행]을 클릭하면 정기 실행을 기다릴 필요 없이 즉시 한 번 실행할 수 있습니다. 잠시 후 실행 작업 기록과 해당 로그를 확인할 수 있습니다.

확인

  1. “관리 / 자동 트리거 설정”에서 해당 작업이 자동 트리거 설정으로 존재하는지 확인하고, 작업 기록과 로그를 확인해 이상이 있는지 점검합니다.
  2. Guance의 “인프라 / 사용자 정의”에서 자산 정보가 있는지 확인합니다.
  3. Guance의 “지표”에서 해당 모니터링 데이터가 있는지 확인합니다.

지표

Amazon CloudWatch를 설정하면 기본 지표 세트는 다음과 같습니다. 설정을 통해 더 많은 지표를 수집할 수 있습니다. Amazon CloudWatch 지표 상세 정보

DEFAULT 수준 모니터링

아래 표에 설명된 지표는 DEFAULT 모니터링 수준에서 사용할 수 있습니다. 이 지표들은 무료입니다.

DEFAULT 모니터링 수준에서 사용할 수 있는 지표
이름 표시 조건 Dimensions 설명
ActiveControllerCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름 어떤 시점에서든 각 클러스터에는 하나의 컨트롤러만 활성 상태일 수 있습니다.
BurstBalance 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 클러스터의 EBS 볼륨에 대한 입출력 버스트 크레딧의 잔여량입니다. 지연 또는 처리량 감소를 조사할 때 사용합니다. BurstBalance는 볼륨의 기준 성능이 최대 버스트 성능보다 높을 때는 보고되지 않습니다. 자세한 내용은 I/O 크레딧 및 버스트 성능를 참고하세요.
BytesInPerSec 토픽 생성 후. 클러스터 이름, 브로커 ID, 토픽 클라이언트로부터 초당 수신된 바이트 수입니다. 이 지표는 각 브로커와 각 토픽 단위로도 적용됩니다.
BytesOutPerSec 토픽 생성 후. 클러스터 이름, 브로커 ID, 토픽 클라이언트로 전송된 초당 바이트 수입니다. 이 지표는 각 브로커와 각 토픽 단위로도 적용됩니다.
ClientConnectionCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID, 클라이언트 인증 인증된 활성 클라이언트 연결 수입니다.
ConnectionCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 인증된 활성 연결, 인증되지 않은 연결, 브로커 간 연결의 수입니다.
CPUCreditBalance 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 이 지표는 브로커의 CPU 크레딧 잔액을 모니터링하는 데 도움이 됩니다. CPU 사용률이 기준 활용률 20%를 지속적으로 초과하면 CPU 크레딧 잔액이 소진될 수 있으며, 이로 인해 클러스터 성능에 부정적인 영향을 줄 수 있습니다. CPU 부하를 줄이기 위한 조치를 취할 수 있습니다. 예를 들어 클라이언트 요청 수를 줄이거나 브로커 유형을 M5 브로커 유형으로 업데이트할 수 있습니다.
CpuIdle 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID CPU 유휴 시간 비율입니다.
CpuIoWait 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 대기 중인 디스크 작업 동안의 CPU 유휴 시간 비율입니다.
CpuSystem 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 커널 공간의 CPU 비율입니다.
CpuUser 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 사용자 공간의 CPU 비율입니다.
GlobalPartitionCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름 클러스터의 모든 토픽에서 복제본을 제외한 파티션 수입니다. GlobalPartitionCount는 복제본을 포함하지 않으므로, 토픽의 복제 계수가 1보다 큰 경우 PartitionCount 값의 합이 GlobalPartitionCount보다 클 수 있습니다.
GlobalTopicCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름 클러스터의 모든 브로커에 걸친 토픽 총 수입니다.
EstimatedMaxTimeLag 컨슈머 그룹이 토픽을 소비한 후. 컨슈머 그룹, 토픽 MaxOffsetLag가 소진될 것으로 추정되는 시간(초)입니다.
KafkaAppLogsDiskUsed 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 애플리케이션 로그에 사용되는 디스크 공간의 비율입니다.
KafkaDataLogsDiskUsedCluster Name, Broker ID 차원) 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 데이터 로그에 사용되는 디스크 공간의 비율입니다.
KafkaDataLogsDiskUsedCluster Name 차원) 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름 데이터 로그에 사용되는 디스크 공간의 비율입니다.
LeaderCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 복제본을 제외한 각 브로커의 파티션 리더 총 수입니다.
MaxOffsetLag 컨슈머 그룹이 토픽을 소비한 후. 컨슈머 그룹, 토픽 토픽의 모든 파티션에 대한 최대 오프셋 지연입니다.
MemoryBuffered 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 버퍼 메모리 크기(바이트)입니다.
MemoryCached 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 캐시된 메모리 크기(바이트)입니다.
MemoryFree 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커에서 사용할 수 있는 가용 메모리 크기(바이트)입니다.
HeapMemoryAfterGC 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 가비지 컬렉션 후 사용된 힙 메모리가 전체 힙 메모리에서 차지하는 비율입니다.
MemoryUsed 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커가 사용 중인 메모리 크기(바이트)입니다.
MessagesInPerSec 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 초당 유입 메시지 수입니다.
NetworkRxDropped 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 드롭된 수신 패킷 수입니다.
NetworkRxErrors 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 네트워크 수신 오류 수입니다.
NetworkRxPackets 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커가 수신한 패킷 수입니다.
NetworkTxDropped 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 드롭된 전송 패킷 수입니다.
NetworkTxErrors 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 네트워크 전송 오류 수입니다.
NetworkTxPackets 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커가 전송한 패킷 수입니다.
OfflinePartitionsCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름 클러스터에서 오프라인 상태인 파티션의 총 수입니다.
PartitionCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 복제본을 포함한 각 브로커의 토픽 파티션 총 수입니다.
ProduceTotalTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 평균 생성 시간(밀리초)입니다.
RequestBytesMean 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 요청 바이트 평균 수입니다.
RequestTime 요청 제한이 적용된 후. 클러스터 이름, 브로커 ID 브로커 네트워크 및 I/O 스레드가 요청을 처리하는 데 걸리는 평균 시간(밀리초)입니다.
RootDiskUsed 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커가 사용 중인 루트 디스크의 비율입니다.
SumOffsetLag 컨슈머 그룹이 토픽을 소비한 후. 컨슈머 그룹, 토픽 토픽의 모든 파티션에 대한 누적 오프셋 지연입니다.
SwapFree 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커에서 사용할 수 있는 스왑 메모리 크기(바이트)입니다.
SwapUsed 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커가 사용 중인 스왑 메모리 크기(바이트)입니다.
TrafficShaping 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 네트워크 할당을 초과해 형성된(드롭되거나 대기열에 들어간) 패킷 수를 나타내는 고급 지표입니다. PER_BROKER 지표는 더 자세한 정보를 제공합니다.
UnderMinIsrPartitionCount 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 완전히 관리되지 않은 파티션 수입니다.
UnderReplicatedPartitions 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커의 완전히 복제되지 않은 파티션 수입니다.
ZooKeeperRequestLatencyMsMean 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커에서 발생한 Apache ZooKeeper 요청의 평균 지연 시간(밀리초)입니다.
ZooKeeperSessionState 클러스터가 ACTIVE 상태가 된 후. 클러스터 이름, 브로커 ID 브로커 ZooKeeper 세션의 연결 상태는 다음 중 하나일 수 있습니다: NOT_CONNECTED: '0.0', ASSOCIATING: '0.1', CONNECTING: '0.5', CONNECTEDREADONLY: '0.8', CONNECTED: '1.0', CLOSED: '5.0', AUTH_FAILED: '10.0'.

PER_BROKER 수준 모니터링

모니터링 수준을 PER_BROKER로 설정하면 DEFAULT 수준의 모든 지표 외에도 아래 표에 설명된 지표를 추가로 사용할 수 있습니다. 아래 표의 지표는 요금이 부과되며, DEFAULT 수준 지표는 여전히 무료입니다. 이 표의 지표는 다음 차원을 가집니다: 클러스터 이름, 브로커 ID.

PER_BROKER 모니터링 수준에서 추가로 제공되는 지표
이름 표시 조건 설명
BwInAllowanceExceeded 클러스터가 ACTIVE 상태가 된 후. 인바운드 집계 대역폭이 브로커의 최대 대역폭을 초과해 형성된 패킷 수입니다.
BwOutAllowanceExceeded 클러스터가 ACTIVE 상태가 된 후. 아웃바운드 집계 대역폭이 브로커의 최대 대역폭을 초과해 형성된 패킷 수입니다.
ConnTrackAllowanceExceeded 클러스터가 ACTIVE 상태가 된 후. 연결 추적이 브로커의 최대값을 초과해 형성된 패킷 수입니다. 연결 추적은 보안 그룹과 관련되어 있으며, 보안 그룹은 설정된 각 연결을 추적하여 반환 패킷이 예상대로 전달되는지 확인합니다.
ConnectionCloseRate 클러스터가 ACTIVE 상태가 된 후. 리스너당 초당 닫힌 연결 수입니다. 이 수치는 리스너별로 집계된 다음 클라이언트 리스너에 대해 필터링됩니다.
ConnectionCreationRate 클러스터가 ACTIVE 상태가 된 후. 리스너당 초당 생성된 새 연결 수입니다. 이 수치는 리스너별로 집계된 다음 클라이언트 리스너에 대해 필터링됩니다.
CpuCreditUsage 클러스터가 ACTIVE 상태가 된 후. 이 지표는 인스턴스의 CPU 크레딧 사용량을 모니터링하는 데 도움이 됩니다. CPU 사용률이 기준 수준 20%를 지속적으로 초과하면 CPU 크레딧 잔액이 소진될 수 있으며, 이로 인해 클러스터 성능에 부정적인 영향을 줄 수 있습니다. 이 지표를 모니터링하고 경보를 설정해 시정 조치를 취할 수 있습니다.
FetchConsumerLocalTimeMsMean 프로듀서/컨슈머가 제공된 후. 리더에서 컨슈머 요청을 처리하는 데 걸리는 평균 시간(밀리초)입니다.
FetchConsumerRequestQueueTimeMsMean 프로듀서/컨슈머가 제공된 후. 컨슈머 요청이 요청 큐에서 대기한 평균 시간(밀리초)입니다.
FetchConsumerResponseQueueTimeMsMean 프로듀서/컨슈머가 제공된 후. 컨슈머 요청이 응답 큐에서 대기한 평균 시간(밀리초)입니다.
FetchConsumerResponseSendTimeMsMean 프로듀서/컨슈머가 제공된 후. 컨슈머에게 응답을 보내는 데 걸린 평균 시간(밀리초)입니다.
FetchConsumerTotalTimeMsMean 프로듀서/컨슈머가 제공된 후. 컨슈머가 브로커에서 데이터를 가져오는 데 걸린 총 평균 시간(밀리초)입니다.
FetchFollowerLocalTimeMsMean 프로듀서/컨슈머가 제공된 후. 리더에서 팔로워 요청을 처리하는 데 걸리는 평균 시간(밀리초)입니다.
FetchFollowerRequestQueueTimeMsMean 프로듀서/컨슈머가 제공된 후. 팔로워 요청이 요청 큐에서 대기한 평균 시간(밀리초)입니다.
FetchFollowerResponseQueueTimeMsMean 프로듀서/컨슈머가 제공된 후. 팔로워 요청이 응답 큐에서 대기한 평균 시간(밀리초)입니다.
FetchFollowerResponseSendTimeMsMean 프로듀서/컨슈머가 제공된 후. 팔로워에게 응답을 보내는 데 걸린 평균 시간(밀리초)입니다.
FetchFollowerTotalTimeMsMean 프로듀서/컨슈머가 제공된 후. 팔로워가 브로커에서 데이터를 가져오는 데 걸린 총 평균 시간(밀리초)입니다.
FetchMessageConversionsPerSec 토픽 생성 후. 브로커가 초당 수행하는 가져오기 메시지 변환 횟수입니다.
FetchThrottleByteRate 대역폭 제한이 적용된 후. 초당 제한되는 바이트 수입니다.
FetchThrottleQueueSize 대역폭 제한이 적용된 후. 제한 큐의 메시지 수입니다.
FetchThrottleTime 대역폭 제한이 적용된 후. 평균 가져오기 제한 시간(밀리초)입니다.
NetworkProcessorAvgIdlePercent 클러스터가 ACTIVE 상태가 된 후. 네트워크 프로세서가 유휴 상태인 시간의 평균 비율입니다.
PpsAllowanceExceeded 클러스터가 ACTIVE 상태가 된 후. 양방향 PPS가 브로커의 최대값을 초과해 형성된 패킷 수입니다.
ProduceLocalTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 리더가 요청을 처리하는 평균 시간(밀리초)입니다.
ProduceMessageConversionsPerSec 토픽 생성 후. 브로커가 초당 생성하는 메시지 변환 수입니다.
ProduceMessageConversionsTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 메시지 형식 변환에 걸린 평균 시간(밀리초)입니다.
ProduceRequestQueueTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 요청 메시지가 큐에서 대기한 평균 시간(밀리초)입니다.
ProduceResponseQueueTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 응답 메시지가 큐에서 대기한 평균 시간(밀리초)입니다.
ProduceResponseSendTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 응답 메시지를 보내는 데 걸린 평균 시간(밀리초)입니다.
ProduceThrottleByteRate 대역폭 제한이 적용된 후. 초당 제한되는 바이트 수입니다.
ProduceThrottleQueueSize 대역폭 제한이 적용된 후. 제한 큐의 메시지 수입니다.
ProduceThrottleTime 대역폭 제한이 적용된 후. 평균 생성 제한 시간(밀리초)입니다.
ProduceTotalTimeMsMean 클러스터가 ACTIVE 상태가 된 후. 평균 생성 시간(밀리초)입니다.
RemoteBytesInPerSec 프로듀서/컨슈머가 있는 경우. 컨슈머 가져오기에 응답하기 위해 계층화 스토리지에서 전송된 총 바이트 수입니다. 이 지표에는 다운스트림 데이터 전송 트래픽에 영향을 주는 모든 토픽 파티션이 포함됩니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteBytesOutPerSec 프로듀서/컨슈머가 있는 경우. 로그 세그먼트, 인덱스 및 기타 보조 파일의 데이터를 포함하여 계층화 스토리지로 전송된 총 바이트 수입니다. 이 지표에는 업스트림 데이터 전송 트래픽에 영향을 주는 모든 토픽 파티션이 포함됩니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteLogManagerTasksAvgIdlePercent 클러스터가 ACTIVE 상태가 된 후. 원격 로그 관리자가 유휴 상태인 시간의 평균 비율입니다. 원격 로그 관리자는 데이터를 브로커에서 계층화 스토리지로 전송합니다. 범주: 내부 활동. 이 지표는 KIP-405 지표입니다.
RemoteLogReaderAvgIdlePercent 클러스터가 ACTIVE 상태가 된 후. 원격 로그 리더가 유휴 상태인 시간의 평균 비율입니다. 원격 로그 리더는 컨슈머 가져오기에 응답하기 위해 원격 스토리지에서 브로커로 데이터를 전송합니다. 범주: 내부 활동. 이 지표는 KIP-405 지표입니다.
RemoteLogReaderTaskQueueSize 클러스터가 ACTIVE 상태가 된 후. 계층화 스토리지에서 읽기를 수행하고 스케줄 대기 중인 작업 수입니다. 범주: 내부 활동. 이 지표는 KIP-405 지표입니다.
RemoteReadErrorPerSec 클러스터가 ACTIVE 상태가 된 후. 컨슈머 가져오기에 응답하기 위해 지정된 브로커가 데이터를 조회하도록 계층화 스토리지로 보낸 읽기 요청의 총 오류율입니다. 이 지표에는 다운스트림 데이터 전송 트래픽에 영향을 주는 모든 토픽 파티션이 포함됩니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteReadRequestsPerSec 클러스터가 ACTIVE 상태가 된 후. 컨슈머 가져오기에 응답하기 위해 지정된 브로커가 데이터를 조회하도록 계층화 스토리지로 보낸 읽기 요청의 총 수입니다. 이 지표에는 다운스트림 데이터 전송 트래픽에 영향을 주는 모든 토픽 파티션이 포함됩니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteWriteErrorPerSec 클러스터가 ACTIVE 상태가 된 후. 지정된 브로커가 업스트림 데이터 전송을 위해 계층화 스토리지로 보낸 쓰기 요청의 총 오류율입니다. 이 지표에는 업스트림 데이터 전송 트래픽에 영향을 주는 모든 토픽 파티션이 포함됩니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
ReplicationBytesInPerSec 토픽 생성 후. 다른 브로커로부터 초당 수신된 바이트 수입니다.
ReplicationBytesOutPerSec 토픽 생성 후. 다른 브로커로 초당 전송된 바이트 수입니다.
RequestExemptFromThrottleTime 요청 제한이 적용된 후. 브로커 네트워크 및 I/O 스레드가 제한에서 제외된 요청을 처리하는 데 걸린 평균 시간(밀리초)입니다.
RequestHandlerAvgIdlePercent 클러스터가 ACTIVE 상태가 된 후. 요청 처리기 스레드가 유휴 상태인 시간의 평균 비율입니다.
RequestThrottleQueueSize 요청 제한이 적용된 후. 제한 큐의 메시지 수입니다.
RequestThrottleTime 요청 제한이 적용된 후. 평균 요청 제한 시간(밀리초)입니다.
TcpConnections 클러스터가 ACTIVE 상태가 된 후. SYN 플래그가 설정된 인바운드 및 아웃바운드 TCP 세그먼트 수를 표시합니다.
TotalTierBytesLag 토픽 생성 후. 브로커에서 계층화 대상이지만 아직 계층화 스토리지로 전송되지 않은 데이터의 총 바이트 수입니다. 이 지표는 업스트림 데이터 전송의 효율성을 보여줍니다. 지연이 증가할수록 계층화 스토리지에 아직 없는 데이터의 양도 증가합니다. 범주: 아카이브 지연. 이 지표는 KIP-405 지표가 아닙니다.
TrafficBytes 클러스터가 ACTIVE 상태가 된 후. 총 바이트 수 기준으로 클라이언트(프로듀서와 컨슈머)와 브로커 간의 네트워크 트래픽을 표시합니다. 브로커 간 트래픽은 보고되지 않습니다.
VolumeQueueLength 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안 완료를 기다리는 읽기 및 쓰기 작업 요청 수입니다.
VolumeReadBytes 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안 읽은 바이트 수입니다.
VolumeReadOps 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안의 읽기 작업 수입니다.
VolumeTotalReadTime 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안 완료된 모든 읽기 작업에 소요된 총 초 수입니다.
VolumeTotalWriteTime 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안 완료된 모든 쓰기 작업에 소요된 총 초 수입니다.
VolumeWriteBytes 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안 기록된 바이트 수입니다.
VolumeWriteOps 클러스터가 ACTIVE 상태가 된 후. 지정된 기간 동안의 쓰기 작업 수입니다.

PER_TOPIC_PER_BROKER 수준 모니터링

모니터링 수준을 PER_TOPIC_PER_BROKER로 설정하면 PER_BROKERDEFAULT 수준의 모든 지표 외에도 아래 표에 설명된 지표를 추가로 사용할 수 있습니다. DEFAULT 수준 지표만 무료입니다. 이 표의 지표는 다음 차원을 가집니다: 클러스터 이름, 브로커 ID, 토픽.

중요: Apache Kafka 2.4.1 이상 버전을 사용하는 Amazon MSK 클러스터의 경우, 아래 표의 지표는 값이 처음으로 0이 아닌 값이 된 후에만 표시됩니다. 예를 들어 BytesInPerSec를 보려면 하나 이상의 프로듀서가 먼저 클러스터로 데이터를 보내야 합니다.

PER_TOPIC_PER_BROKER 모니터링 수준에서 추가로 제공되는 지표
이름 표시 조건 설명
FetchMessageConversionsPerSec 토픽 생성 후. 초당 변환된 가져오기 메시지 수입니다.
MessagesInPerSec 토픽 생성 후. 초당 수신된 메시지 수입니다.
ProduceMessageConversionsPerSec 토픽 생성 후. 생성된 메시지의 초당 변환 횟수입니다.
RemoteBytesInPerSec 토픽을 생성한 뒤 해당 토픽이 생성/소비 중인 경우. 지정된 토픽과 브로커에 대한 컨슈머 가져오기에 응답하기 위해 계층화 스토리지에서 전송된 바이트 수입니다. 이 지표에는 해당 토픽의 모든 파티션이 포함되며, 지정된 브로커의 상하류 데이터 전송 트래픽에 영향을 줍니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteBytesOutPerSec 토픽을 생성한 뒤 해당 토픽이 생성/소비 중인 경우. 지정된 토픽과 브로커에 대해 계층화 스토리지로 전송된 바이트 수입니다. 이 지표에는 해당 토픽의 모든 파티션이 포함되며, 지정된 브로커의 업스트림 데이터 전송 트래픽에 영향을 줍니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteReadErrorPerSec 토픽을 생성한 뒤 해당 토픽이 생성/소비 중인 경우. 지정된 토픽에 대한 컨슈머 가져오기에 응답하기 위해 지정된 브로커가 데이터를 조회하도록 계층화 스토리지로 보낸 읽기 요청의 오류율입니다. 이 지표에는 해당 토픽의 모든 파티션이 포함되며, 지정된 브로커의 상하류 데이터 전송 트래픽에 영향을 줍니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteReadRequestsPerSec 토픽을 생성한 뒤 해당 토픽이 생성/소비 중인 경우. 지정된 토픽에 대한 컨슈머 가져오기에 응답하기 위해 지정된 브로커가 데이터를 조회하도록 계층화 스토리지로 보낸 읽기 요청 수입니다. 이 지표에는 해당 토픽의 모든 파티션이 포함되며, 지정된 브로커의 상하류 데이터 전송 트래픽에 영향을 줍니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.
RemoteWriteErrorPerSec 토픽을 생성한 뒤 해당 토픽이 생성/소비 중인 경우. 지정된 브로커가 업스트림 데이터 전송을 위해 계층화 스토리지로 보낸 쓰기 요청의 오류율입니다. 이 지표에는 해당 토픽의 모든 파티션이 포함되며, 지정된 브로커의 업스트림 데이터 전송 트래픽에 영향을 줍니다. 범주: 트래픽 및 오류율. 이 지표는 KIP-405 지표입니다.

PER_TOPIC_PER_PARTITION 수준 모니터링

모니터링 수준을 PER_TOPIC_PER_PARTITION로 설정하면 PER_TOPIC_PER_BROKER, PER_BROKERDEFAULT 수준의 모든 지표 외에도 아래 표에 설명된 지표를 추가로 사용할 수 있습니다. DEFAULT 수준 지표만 무료입니다. 이 표의 지표는 다음 차원을 가집니다: 컨슈머 그룹, 토픽, 파티션.

PER_TOPIC_PER_PARTITION 모니터링 수준에서 추가로 제공되는 지표
이름 표시 조건 설명
EstimatedTimeLag 컨슈머 그룹이 토픽을 소비한 후. 파티션 오프셋 지연이 소진될 것으로 추정되는 시간(초)입니다.
OffsetLag 컨슈머 그룹이 토픽을 소비한 후. 파티션 수준 컨슈머의 오프셋 지연입니다.

객체

AWS MSK 객체 데이터는 아직 없습니다.

문서 평가

이 페이지가 도움이 되었나요?