본문으로 건너뛰기

모니터링 메트릭

카카오클라우드의 Monitoring 서비스에서 제공하는 메트릭을 설명합니다.

Virtual Machine, GPU, Bare Metal Server 메트릭​

Virtual Machine, GPU, Bare Metal Server에서 공통으로 수집되는 주요 시스템 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위권장 용도
cpu_usage전체 CPU 사용률%주요 성능 지표
cpu_usage_userCPU 사용률, CPU 상태: user%사용자 프로세스 부하 확인
cpu_usage_systemCPU 사용률, CPU 상태: system%커널/시스템 부하 확인
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%I/O 병목 현상 진단
cpu_usage_per_core  코어별 CPU 사용률%코어별 부하 불균형 확인
mem_usage메모리 사용률%주요 메모리 경고
mem_used메모리 사용량Bytes(IEC)절대적 사용량 확인
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 리눅스 전용
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)리눅스 전용

Virtual Machine, 버스터블 인스턴스 전용 메트릭​

다음 메트릭은 버스터블(Burstable) 옵션이 적용된 t1i 계열 인스턴스에서만 수집됩니다. (단, t1i.medium.dns.default 타입은 제외)

메트릭 이름설명단위
cpu_credit_usageCPU 크레딧 사용량(기준 성능을 초과하여 CPU를 사용할 때 소비된 크레딧의 누적 양)Count
cpu_credit_balanceCPU 크레딧 잔여량(기준 성능 이하로 동작할 때 적립된 크레딧)Count
정보
  • mem_buffered, mem_cached, disk_inodes_usage 메트릭은 Linux OS가 설치된 서버에서만 수집 및 제공됩니다.
  • nvidia_smi 메트릭은 GPU가 장착된 서버에서만 수집됩니다.
주의
  • GPU 인스턴스 라이브러리 호환성: GPU 인스턴스의 NVIDIA 라이브러리를 업데이트할 경우, CUDA 버전과 호환성을 반드시 확인하세요. 호환되지 않는 경우, 모니터링 에이전트가 NVIDIA 메트릭을 수집하지 못할 수 있습니다.
  • 네트워크 알림 정책: network_rx_bytes_persec 메트릭으로 Alert Center 알림 정책을 설정할 경우, 해당 정책은 모든 네트워크 인터페이스에 적용됩니다. 다중 NIC 인스턴스에서는 연결된 인터페이스 중 하나라도 설정된 임계치를 초과하면 알림이 발송됩니다.

Libvirt 메트릭​

Libvirt 환경에서 수집되는 가상화 기반 서버의 주요 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
메트릭 이름설명단위
libvirt_domain_info_cpu_time_seconds_total사용한 총 CPU 시간Count
libvirt_domain_info_virtual_cpusCPU 코어 개수Count

Kubernetes Engine 메트릭​

Kubernetes Engine 환경에서 수집되는 주요 클러스터, 노드, 파드 리소스 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
cluster_autoscaler_node_group_min_count노드 풀의 오토스케일링 동작 시 최소 노드 개수Count
cluster_autoscaler_node_group_max_count노드 풀의 오토스케일링 동작 시 최대 노드 개수Count
cluster_autoscaler_node_group_target_count노드 풀의 오토스케일링 동작 시 목표 노드 개수Count
node_count현재 노드 개수Count

Load Balancing 메트릭​

Load Balancer 리소스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
lb_bytes_in_persec인바운드 트래픽Bytes/s(IEC)
lb_bytes_out_persec아웃바운드 트래픽Bytes/s(IEC)
lb_connections_persec초당 커넥션 개수Count/s
lb_current_connections연결된 커넥션 개수Count
lb_healthy_host_count세션이 연결된 대상 개수Count
lb_unhealthy_host_count세션이 연결되지 않은 대상 개수Count
lb_listener_operating_status리스너 운영 상태 - Healthy(0), Offline(1), Unhealthy(2), Draining(3)None
lb_tg_operating_status대상 그룹 운영 상태 - Healthy(0), Offline(1), Unhealthy(2), Draining(3), Degraded(5)None
lb_target_operating_status대상 운영 상태 - Healthy(0), Offline(1), Unhealthy(2), Draining(3), No Monitor(4)None

Transit Gateway 메트릭​

Transit Gateway 리소스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
tgw_packet_bytestgw에서 처리한 총 데이터 크기Bytes(IEC)
tgw_packet_counttgw에서 처리한 총 패킷 개수Count

MySQL 메트릭​

MySQL 인스턴스의 스토리지, 네트워크, 쿼리, 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
cpu_usage전체 CPU 사용률%
cpu_usage_userCPU 사용률, CPU 상태: user%
cpu_usage_systemCPU 사용률, CPU 상태: system%
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%
cpu_usage_per_core  코어별 CPU 사용률%
mem_swap_total총 swap 메모리Bytes(IEC)
mem_swap_cached캐시된 swap 메모리Bytes(IEC)
mem_swap_free사용 가능한 swap 메모리Bytes(IEC)
mem_usage메모리 사용률%
mem_used메모리 사용량Bytes(IEC)
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)

PostgreSQL 메트릭​

PostgreSQL 인스턴스의 디스크, 네트워크, 연결, 트랜잭션 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
cpu_usage전체 CPU 사용률%
cpu_usage_userCPU 사용률, CPU 상태: user%
cpu_usage_systemCPU 사용률, CPU 상태: system%
cpu_usage_iowaitCPU 사용률, CPU 상태: iowait%
cpu_usage_per_core  코어별 CPU 사용률%
mem_swap_total총 swap 메모리Bytes(IEC)
mem_swap_cached캐시된 swap 메모리Bytes(IEC)
mem_swap_free사용 가능한 swap 메모리Bytes(IEC)
mem_usage메모리 사용률%
mem_used메모리 사용량Bytes(IEC)
mem_buffered메모리 사용량, 메모리 상태: bufferedBytes(IEC) 
mem_cached메모리 사용량, 메모리 상태: cachedBytes(IEC)

MemStore 메트릭​

MemStore 인스턴스의 메모리, 네트워크, 복제 및 CPU 사용 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기, Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
memstore_used_cpu_sys서버 프로세스의 모든 스레드(메인 스레드 및 백그라운드 스레드)에서 사용된 시스템 CPUCount
memstore_used_cpu_sys_main_thread메인 스레드에서 사용된 시스템 CPUCount
memstore_used_cpu_user사용자 프로세스의 모든 스레드(메인 스레드 및 백그라운드 스레드)에서 사용된 사용자 CPUCount
memstore_used_cpu_user_main_thread메인 스레드에서 사용된 사용자 CPUCount
memstore_memory_usageMemStore 인스턴스에서 사용하는 메모리 사용률%
memstore_used_memoryMemStore 데이터베이스가 사용한 메모리Bytes(IEC)
memstore_used_memory_peakMemStore 데이터베이스가 사용한 최대 메모리Bytes(IEC)
memstore_used_memory_peak_perc전체 메모리 사용에 대한 최대 메모리 사용 비율%
memstore_used_memory_datasetoverhead 메모리를 고려하여 실제 데이터 저장에 사용되는 메모리Bytes(IEC)
memstore_used_memory_dataset_percoverhead 메모리를 고려하여 실제 데이터 저장에 사용되는 메모리의 비율%
memstore_used_memory_overhead내부 데이터 구조를 관리하는 데 필요한 모든 overhead 메모리Bytes(IEC)
memstore_used_memory_luaLua 엔진이 스크립트를 실행하는 데 사용되는 메모리Bytes(IEC)
memstore_allocator_allocatedallocator에 할당된 메모리, internal-fragmentation을 포함Bytes(IEC)
memstore_allocator_activeallocator에서 활성화된 메모리, external-fragmentation을 포함Bytes(IEC)
memstore_allocator_residentallocator에서 관리중인 resident 메모리, OS에 반환 가능한 메모리를 포함Bytes(IEC)
memstore_allocator_rss_bytesRSS 메모리 크기Bytes(IEC)
memstore_allocator_frag_bytesallocator에서 활성화된 메모리와 할당된 메모리 간의 차이Bytes(IEC)
memstore_allocator_frag_ratioallocator에서 활성화된 메모리와 할당된 메모리 간의 비율%
memstore_allocator_rss_ratioallocator에서 관리중인 resident 메모리와 활성화된 메모리 간의 비율%
memstore_mem_fragmentation_bytesMemStore 데이터베이스에서 사용중인 resident 메모리와 할당된 메모리 간의 차이Bytes(IEC)
memstore_mem_fragmentation_ratioMemStore 데이터베이스에서 사용중인 resident 메모리와 할당된 메모리 간의 비율%
memstore_rss_overhead_bytesMemStore 데이터베이스 프로세스의 resident 메모리와 allocator에서 관리중인 resident 메모리 간의 차이Bytes(IEC)
memstore_rss_overhead_ratioMemStore 데이터베이스 프로세스의 resident 메모리와 allocator에서 관리중인 resident 메모리 간의 비율%
memstore_total_system_memoryMemStore 데이터베이스가 실행중인 시스템의 메모리Bytes(IEC)

버스터블 인스턴스 전용 메트릭​

다음 메트릭은 버스터블(Burstable) 옵션이 적용된 t1i 계열 인스턴스에서만 수집됩니다.

메트릭 이름설명단위
cpu_credit_usageCPU 크레딧 사용량(기준 성능을 초과하여 CPU를 사용할 때 소비된 크레딧의 누적 양)Count
cpu_credit_balanceCPU 크레딧 잔여량(기준 성능 이하로 동작할 때 적립된 크레딧)Count

Hadoop Eco 메트릭​

Hadoop Eco 환경에서 수집되는 주요 HBase, HDFS, Yarn, Kafka 관련 시스템 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
HBase_Master_JvmMetrics_MemHeapMaxMHBase Master의 JVM 힙 메모리 최대 크기MiB(IEC)
HBase_Master_JvmMetrics_MemHeapUsedMHBase Master의 JVM 힙 메모리 사용량MiB(IEC)
HBase_Master_Server_numDeadRegionServers비정상(Dead) 상태의 리전 서버 개수Count
HBase_Master_Server_numRegionServers현재 정상 동작 중인 리전 서버 개수Count

Pub/Sub 메트릭​

Pub/Sub 서비스의 메시지 게시, 구독, 저장 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: 커스텀 대시보드, 메트릭 탐색기
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
pubsub_published_message_count_persec초당 게시된 메시지 개수Count/s
pubsub_published_message_bytes_persec초당 게시된 메시지 크기Bytes/s(IEC)
pubsub_publish_request_count_persec초당 게시 요청 횟수Count/s
pubsub_topic_storage_used_bytes토픽 보관 데이터 크기Bytes(IEC)

Advanced Managed Kafka 메트릭​

Advanced Managed Kafka 인스턴스의 브로커, 파티션, 토픽 처리량 및 서버 리소스 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
cpu_usage전체 CPU 사용률%
mem_usage메모리 사용률%

Advanced Managed Search 메트릭​

Advanced Managed Search(OpenSearch) 클러스터의 노드, 인덱스, 검색 처리 및 리소스 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
  • Alert Center: 메트릭 기반 알림 정책 설정
메트릭 이름설명단위
opensearch_process_cpu_percentOpenSearch 프로세스 CPU 사용률%
opensearch_jvm_mem_heap_used_percentHeap 메모리 사용률%
opensearch_jvm_mem_heap_used_bytesHeap 메모리 사용량Bytes(IEC)
opensearch_os_mem_used_bytesOS 메모리 사용량Bytes(IEC)
opensearch_jvm_gc_collection_count누적 GC 수행 횟수Count
opensearch_circuitbreaker_tripped_countCircuit Breaker 발동 횟수Count
opensearch_threadpool_tasks_number스레드 풀 작업 개수Count
opensearch_threadpool_threads_count스레드 풀 스레드 개수Count

Direct Connect 메트릭​

Direct Connect 가상 인터페이스의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
dx_virtual_interface_input_bits_persecDirect Connect 가상 인터페이스 인바운드 트래픽Bits/s(IEC)
dx_virtual_interface_output_bits_persecDirect Connect 가상 인터페이스 아웃바운드 트래픽Bits/s(IEC)
dx_virtual_interface_input_packets_persecDirect Connect 가상 인터페이스에서 받은 초당 패킷 개수Packets/s
dx_virtual_interface_output_packets_persecDirect Connect 가상 인터페이스에서 보낸 초당 패킷 개수Packets/s

Gateway Load Balancer 메트릭​

Gateway Load Balancer 및 Endpoint Service의 트래픽, 연결, 헬스 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
gwlb_bytes_in_persecGWLB 인바운드 트래픽Bytes/s(IEC)
gwlb_bytes_out_persecGWLB 아웃바운드 트래픽Bytes/s(IEC)
eps_bytes_in_persec엔드포인트 서비스 인바운드 트래픽Bytes/s(IEC)
eps_bytes_out_persec엔드포인트 서비스 아웃바운드 트래픽Bytes/s(IEC)
ep_bytes_in_persec엔드포인트 인바운드 트래픽Bytes/s(IEC)
ep_bytes_out_persec엔드포인트 아웃바운드 트래픽Bytes/s(IEC)

Private Endpoint 메트릭​

Private Endpoint의 트래픽 및 연결 상태를 모니터링하기 위한 주요 메트릭으로, 다음 서비스 영역에서 활용할 수 있습니다.

  • Monitoring: Metric Export
메트릭 이름설명단위
ep_bytes_in_persec엔드포인트 인바운드 트래픽Bytes/s(IEC)
ep_bytes_out_persec엔드포인트 아웃바운드 트래픽Bytes/s(IEC)