본문으로 건너뛰기

모니터링 메트릭

카카오클라우드의 Monitoring 서비스에서 제공하는 메트릭을 설명합니다.

Virtual Machine, GPU, Bare Metal Server 메트릭

Virtual Machine, GPU, Bare Metal Server에서 공통으로 수집되는 주요 시스템 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위권장 용도
cpu_usage전체 CPU 사용률%주요 성능 지표
cpu_usage_userCPU 사용률, CPU 상태: user%사용자 프로세스 부하 확인
cpu_usage_systemCPU 사용률, CPU 상태: system%커널/시스템 부하 확인
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%I/O 병목 현상 진단
cpu_usage_per_core  코어별 CPU 사용률%코어별 부하 불균형 확인
mem_usage메모리 사용률%주요 메모리 경고
mem_used메모리 사용량Bytes(IEC)절대적 사용량 확인
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 리눅스 전용
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)리눅스 전용

Virtual Machine, 버스터블 인스턴스 전용 메트릭

다음 메트릭은 버스터블(Burstable) 옵션이 적용된 t1i 계열 인스턴스에서만 수집됩니다. (단, t1i.medium.dns.default 타입은 제외)

메트릭 이름설명단위
cpu_credit_usageCPU 크레딧 사용량(기준 성능을 초과하여 CPU를 사용할 때 소비된 크레딧의 누적 양)Count
cpu_credit_balanceCPU 크레딧 잔여량(기준 성능 이하로 동작할 때 적립된 크레딧)Count
정보
  • mem_buffered, mem_cached, disk_inodes_usage 메트릭은 Linux OS가 설치된 서버에서만 수집 및 제공됩니다.
  • nvidia_smi 메트릭은 GPU가 장착된 서버에서만 수집됩니다.
주의
  • GPU 인스턴스 라이브러리 호환성: GPU 인스턴스의 NVIDIA 라이브러리를 업데이트할 경우, CUDA 버전과 호환성을 반드시 확인하세요. 호환되지 않는 경우, 모니터링 에이전트가 NVIDIA 메트릭을 수집하지 못할 수 있습니다.
  • 네트워크 알림 정책: network_rx_bytes_persec 메트릭으로 Alert Center 알림 정책을 설정할 경우, 해당 정책은 모든 네트워크 인터페이스에 적용됩니다. 다중 NIC 인스턴스에서는 연결된 인터페이스 중 하나라도 설정된 임계치를 초과하면 알림이 발송됩니다.

Libvirt 메트릭

Libvirt 환경에서 수집되는 가상화 기반 서버의 주요 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
메트릭 이름설명단위
libvirt_domain_info_cpu_time_seconds_total사용한 총 CPU 시간Count
libvirt_domain_info_virtual_cpusCPU 코어 개수Count

Kubernetes Engine 메트릭

Kubernetes Engine 환경에서 수집되는 주요 클러스터, 노드, 파드 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
cluster_autoscaler_node_group_min_count노드 풀의 오토스케일링 동작 시 최소 노드 개수Count
cluster_autoscaler_node_group_max_count노드 풀의 오토스케일링 동작 시 최대 노드 개수Count
cluster_autoscaler_node_group_target_count노드 풀의 오토스케일링 동작 시 목표 노드 개수Count
node_count현재 노드 개수Count

Load Balancing 메트릭

Load Balancer 리소스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
lb_bytes_in_persec인바운드 트래픽Bytes/s(IEC)
lb_bytes_out_persec아웃바운드 트래픽Bytes/s(IEC)
lb_connections_persec초당 커넥션 개수Count/s
lb_current_connections연결된 커넥션 개수Count
lb_healthy_host_count세션이 연결된 대상 개수Count
lb_unhealthy_host_count세션이 연결되지 않은 대상 개수Count

Transit Gateway 메트릭

Transit Gateway 리소스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
tgw_packet_bytestgw에서 처리한 총 데이터 크기Bytes(IEC)
tgw_packet_counttgw에서 처리한 총 패킷 개수Count

MySQL 메트릭

MySQL 인스턴스의 스토리지, 네트워크, 쿼리, 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
cpu_usage전체 CPU 사용률%
cpu_usage_userCPU 사용률, CPU 상태: user%
cpu_usage_systemCPU 사용률, CPU 상태: system%
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%
cpu_usage_per_core  코어별 CPU 사용률%
mem_swap_total총 swap 메모리Bytes(IEC)
mem_swap_cached캐시된 swap 메모리Bytes(IEC)
mem_swap_free사용 가능한 swap 메모리Bytes(IEC)
mem_usage메모리 사용률%
mem_used메모리 사용량Bytes(IEC)
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)

PostgreSQL 메트릭

PostgreSQL 인스턴스의 디스크, 네트워크, 연결, 트랜잭션 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
cpu_usage전체 CPU 사용률%
cpu_usage_userCPU 사용률, CPU 상태: user%
cpu_usage_systemCPU 사용률, CPU 상태: system%
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%
cpu_usage_per_core  코어별 CPU 사용률%
mem_swap_total총 swap 메모리Bytes(IEC)
mem_swap_cached캐시된 swap 메모리Bytes(IEC)
mem_swap_free사용 가능한 swap 메모리Bytes(IEC)
mem_usage메모리 사용률%
mem_used메모리 사용량Bytes(IEC)
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)

MemStore 메트릭

MemStore 인스턴스의 메모리, 네트워크, 복제 및 CPU 사용 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
memstore_used_cpu_sys서버 프로세스의 모든 스레드(메인 스레드 및 백그라운드 스레드)에서 사용된 시스템 CPUCount
memstore_used_cpu_sys_main_thread메인 스레드에서 사용된 시스템 CPUCount
memstore_used_cpu_user사용자 프로세스의 모든 스레드(메인 스레드 및 백그라운드 스레드)에서 사용된 사용자 CPUCount
memstore_used_cpu_user_main_thread메인 스레드에서 사용된 사용자 CPUCount
memstore_memory_usageMemStore 인스턴스에서 사용하는 메모리 사용률%
memstore_used_memoryMemStore 데이터베이스가 사용한 메모리Bytes(IEC)
memstore_used_memory_peakMemStore 데이터베이스가 사용한 최대 메모리Bytes(IEC)
memstore_used_memory_peak_perc전체 메모리 사용에 대한 최대 메모리 사용 비율%
memstore_used_memory_datasetoverhead 메모리를 고려하여 실제 데이터 저장에 사용되는 메모리Bytes(IEC)
memstore_used_memory_dataset_percoverhead 메모리를 고려하여 실제 데이터 저장에 사용되는 메모리의 비율%
memstore_used_memory_overhead내부 데이터 구조를 관리하는 데 필요한 모든 overhead 메모리Bytes(IEC)
memstore_used_memory_luaLua 엔진이 스크립트를 실행하는 데 사용되는 메모리Bytes(IEC)
memstore_allocator_allocatedallocator에 할당된 메모리, internal-fragmentation을 포함Bytes(IEC)
memstore_allocator_activeallocator에서 활성화된 메모리, external-fragmentation을 포함Bytes(IEC)
memstore_allocator_residentallocator에서 관리중인 resident 메모리, OS에 반환 가능한 메모리를 포함Bytes(IEC)
memstore_allocator_rss_bytesRSS 메모리 크기Bytes(IEC)
memstore_allocator_frag_bytesallocator에서 활성화된 메모리와 할당된 메모리 간의 차이Bytes(IEC)
memstore_allocator_frag_ratioallocator에서 활성화된 메모리와 할당된 메모리 간의 비율%
memstore_allocator_rss_ratioallocator에서 관리중인 resident 메모리와 활성화된 메모리 간의 비율%
memstore_mem_fragmentation_bytesMemStore 데이터베이스에서 사용중인 resident 메모리와 할당된 메모리 간의 차이Bytes(IEC)
memstore_mem_fragmentation_ratioMemStore 데이터베이스에서 사용중인 resident 메모리와 할당된 메모리 간의 비율%
memstore_rss_overhead_bytesMemStore 데이터베이스 프로세스의 resident 메모리와 allocator에서 관리중인 resident 메모리 간의 차이Bytes(IEC)
memstore_rss_overhead_ratioMemStore 데이터베이스 프로세스의 resident 메모리와 allocator에서 관리중인 resident 메모리 간의 비율%
memstore_total_system_memoryMemStore 데이터베이스가 실행중인 시스템의 메모리Bytes(IEC)

버스터블 인스턴스 전용 메트릭

다음 메트릭은 버스터블(Burstable) 옵션이 적용된 t1i 계열 인스턴스에서만 수집됩니다.

메트릭 이름설명단위
cpu_credit_usageCPU 크레딧 사용량(기준 성능을 초과하여 CPU를 사용할 때 소비된 크레딧의 누적 양)Count
cpu_credit_balanceCPU 크레딧 잔여량(기준 성능 이하로 동작할 때 적립된 크레딧)Count

Hadoop Eco 메트릭

Hadoop Eco 환경에서 수집되는 주요 HBase, HDFS, Yarn, Kafka 관련 시스템 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
HBase_Master_JvmMetrics_MemHeapMaxMHBase Master의 JVM 힙 메모리 최대 크기MiB(IEC)
HBase_Master_JvmMetrics_MemHeapUsedMHBase Master의 JVM 힙 메모리 사용량MiB(IEC)
HBase_Master_Server_numDeadRegionServers비정상(Dead) 상태의 리전 서버 개수Count
HBase_Master_Server_numRegionServers현재 정상 동작 중인 리전 서버 개수Count

Pub/Sub 메트릭

Pub/Sub 서비스의 메시지 게시, 구독, 저장 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
pubsub_published_message_count_persec초당 게시된 메시지 개수Count/s
pubsub_published_message_bytes_persec초당 게시된 메시지 크기Bytes/s(IEC)
pubsub_publish_request_count_persec초당 게시 요청 횟수Count/s
pubsub_topic_storage_used_bytes토픽 보관 데이터 크기Bytes(IEC)

Direct Connect 메트릭

Direct Connect 가상 인터페이스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
dx_virtual_interface_input_bits_persecDirect Connect 가상 인터페이스 인바운드 트래픽Bits/s(IEC)
dx_virtual_interface_output_bits_persecDirect Connect 가상 인터페이스 아웃바운드 트래픽Bits/s(IEC)
dx_virtual_interface_input_packets_persecDirect Connect 가상 인터페이스에서 받은 초당 패킷 개수Packets/s
dx_virtual_interface_output_packets_persecDirect Connect 가상 인터페이스에서 보낸 초당 패킷 개수Packets/s

Gateway Load Balancer 메트릭

Gateway Load Balancer 및 Endpoint Service의 트래픽, 연결, 헬스 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
gwlb_bytes_in_persecGWLB 인바운드 트래픽Bytes/s(IEC)
gwlb_bytes_out_persecGWLB 아웃바운드 트래픽Bytes/s(IEC)
eps_bytes_in_persec엔드포인트 서비스 인바운드 트래픽Bytes/s(IEC)
eps_bytes_out_persec엔드포인트 서비스 아웃바운드 트래픽Bytes/s(IEC)
ep_bytes_in_persec엔드포인트 인바운드 트래픽Bytes/s(IEC)
ep_bytes_out_persec엔드포인트 아웃바운드 트래픽Bytes/s(IEC)

Private Endpoint 메트릭

Private Endpoint의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
ep_bytes_in_persec엔드포인트 인바운드 트래픽Bytes/s(IEC)
ep_bytes_out_persec엔드포인트 아웃바운드 트래픽Bytes/s(IEC)