본문으로 건너뛰기

4.1. APM 대시보드

eBPF로 수집한 L7 요청을 근거로 애플리케이션 성능을 거의 실시간으로 보여주는 화면입니다.

APM 대시보드 화면

개요

APM 대시보드는 eBPF로 관측한 L7 요청(스팬) 을 근거로 애플리케이션 성능을 거의 실시간(약 1~5초 지연)으로 보여주는 화면입니다. 지금 이 순간 애플리케이션이 받는 요청량, 응답시간, 오류, 동시 처리량, 자원 사용을 카테고리·네임스페이스 단위로 한 화면에서 모니터링합니다.

운영자·SRE·개발자가 "현재" 상태를 빠르게 파악하는 데 활용합니다. 배포 직후 트래픽 반응을 지켜보거나, 응답시간이 튀는 인스턴스를 즉시 찾아내거나, 오류가 급증한 순간을 포착하는 데 적합합니다. 과거 구간 조회 중심인 애플리케이션 화면과 달리, APM 대시보드는 지연을 최소화한 실시간 데이터 경로를 사용합니다.

좌측 사이드바에서 APM 대시보드(속도계 아이콘) 메뉴를 클릭하면 진입합니다. 이 화면은 항상 "지금"을 기준으로 하는 실시간 전용 화면이므로, 다른 화면과 달리 상단의 시작·종료 시간 선택기를 사용하지 않습니다.

참고: L7은 네트워크 7계층(애플리케이션 계층)을 뜻합니다. eBPF가 커널 수준에서 HTTP·gRPC·데이터베이스 같은 애플리케이션 요청을 관측하므로, 애플리케이션 코드를 수정하거나 별도 라이브러리를 넣지 않아도 성능 데이터가 수집됩니다.

화면 구성

상단 필터 바에서 카테고리네임스페이스로 표시 범위를 정하며, 아래 위젯들이 선택한 범위 기준으로 갱신됩니다.

위젯설명
요청 뷰어동시 요청 수(in-flight) 게이지와 활성 사용자 수, 경과시간 3구간 범례
실시간 요청 모니터링인스턴스별 컬럼과 요청 낙하 애니메이션, 네임스페이스 밴드, 중지 상태 표시
트랜잭션 히트맵(T-Map)응답시간×시간 히트맵. 셀 클릭·드래그로 트레이스·트랜잭션 조회
정보 카드만족도·TPS·활성 사용자·오류율·응답시간(P50/P95)을 요약한 6개 셀
TPS초당 트랜잭션 수 추세(최근 10분)
사용자 만족도(Apdex)만족도 추세와 만족·보통·불만 밴드
응답시간P50·P95 응답시간 추세
오류율오류율(%)과 에러 건수 추세
CPU 사용량 / 메모리 사용량애플리케이션별 상위 자원 사용 추이
활성 사용자최근 10분 활성 사용자 추세
트랜잭션 조회 다이얼로그(드릴다운)상시 위젯이 아니라, T-Map을 드래그해 선택했을 때 뜨는 트랜잭션 목록

참고: 화면 상단에는 실시간 연결 상태 배지(LIVE)가 표시됩니다. 서버와 연결되어 데이터가 흐르는 동안 활성 상태를 유지하며, 연결이 끊기면 자동으로 재연결을 시도합니다.

주요 기능

카테고리 · 네임스페이스 필터

상단 필터 바의 두 콤보로 표시 범위를 정합니다.

  • 카테고리 필터: 카테고리는 항상 하나가 선택되어 있어야 하며 비울 수 없습니다. 카테고리를 바꾸면 그에 속한 애플리케이션의 데이터만 화면에 표시됩니다.
  • 네임스페이스 필터: 선택한 카테고리에 속한 네임스페이스만 목록에 나타나며, 전체(ALL)를 선택할 수 있습니다.

선택을 바꾸면 서버에 다시 구독하여 해당 범위의 데이터만 수신하므로, 관심 있는 서비스 묶음에만 집중할 수 있습니다. 선택 값은 저장되어 다시 접속할 때 복원됩니다.

필터 결과에 해당하는 애플리케이션이 없으면 "선택한 카테고리/네임스페이스에 표시할 앱이 없습니다"라는 안내와 함께 필터를 초기화하는 버튼이 표시됩니다.

: 네임스페이스 선택은 커스텀 대시보드·사용자수 추정 등 다른 화면과 공유됩니다. 한 화면에서 네임스페이스를 고르면 다른 화면에서도 같은 선택이 이어져, 화면을 오가며 같은 대상을 추적하기 편합니다.

필터 바 우측에는 다음 보조 컨트롤이 있습니다.

컨트롤설명
전체화면 토글화면을 전체 화면으로 전환. 팀 공용 모니터에 상시 표시할 때 유용
환경 설정(기어)트래픽 시각 효과 강도 등 화면 표현 옵션 조정
LIVE 배지실시간 연결 상태 표시
집계 지연 배지서버 집계가 지연되면 표시. 데이터가 잠시 오래된 값일 수 있음
상위 N개 안내항목이 너무 많아 일부만 표시될 때 "상위 N개 표시 중" 안내

정보 요약 카드

정보 요약 카드

화면 상단의 정보 카드는 현재 상태를 여섯 개 지표로 요약합니다.

내용
사용자 만족도(Apdex)응답시간 만족도(%). 값에 따라 색으로 상태 표시
TPS초당 트랜잭션(요청) 수
활성 사용자활성 사용자 수 (최근 5분 기준)
오류율전체 요청 대비 오류 비율(%). 값에 따라 색으로 상태 표시
응답시간P50 / P95 응답시간(ms)
30분 활성 사용자최근 30분 기준 활성 사용자 수

값은 마지막으로 완결된 10초 구간을 기준으로 한 최근 값입니다. 만족도·오류율은 상태에 따라 색이 바뀌어(양호=초록, 보통=주황, 불량=빨강) 문제를 한눈에 알 수 있습니다. 데이터가 없으면 "—"로 표시됩니다.

참고: 활성 사용자 라벨에는 산정 기준이 함께 표기됩니다. 세션 커버리지가 충분하면 (Session), 그렇지 않으면 (IP+UA) 기준으로 추정합니다. 두 방식의 차이는 사용자수 추정 문서를 참고하세요.

실시간 추세 차트

실시간 추세 차트

TPS·응답시간·오류율·사용자 만족도를 각각 최근 10분을 10초 단위로 집계해 추세로 보여줍니다. 각 차트 제목 아래에 "최근 10분"이 표기됩니다.

응답시간 차트

P50P95 두 라인으로 응답시간을 보여줍니다. 실시간 L7 값이 없는 환경에서는 평균 응답시간 한 라인으로 대체됩니다.

  • P50(중앙값): 절반의 요청이 이 시간 안에 처리됩니다. 일반적인 사용자 경험을 나타냅니다.
  • P95: 상위 5%의 느린 요청 경계입니다. 꼬리 지연(tail latency)을 파악하는 데 씁니다. P50은 낮은데 P95가 높으면 일부 요청만 느린 상황입니다.

왜 평균이 아니라 P50·P95인가: 응답시간 분포는 대개 오른쪽으로 길게 치우쳐(right-skewed) 있습니다 — 대다수 요청은 빠르고 소수만 매우 느립니다. 이때 평균(Average) 은 이 느린 소수에 끌려 올라가 "실제로 아무도 겪지 않는 값"이 되거나, 반대로 느린 요청을 다수에 희석해 문제를 가리기 쉽습니다. 예를 들어 요청 1,000건 중 990건이 100ms, 10건이 5,000ms라면 평균은 149ms로 정상처럼 보이지만, 실제로는 10명의 사용자가 5초를 기다린 것입니다.

지표위 예의 값무엇을 말해주나
평균(Average)149ms느린 소수에 끌려간 값 — 대표 경험도, 최악 경험도 아님
P50(중앙값)100ms요청을 응답시간 순으로 세웠을 때 한가운데 값 = 대표 사용자가 실제 겪는 경험(느린 소수에 흔들리지 않음)
P955,000ms가장 느린 5%의 경계 = 꼬리 지연(tail latency). 평균이 감추는 부분

사용자 이탈과 SLO/SLA 위반은 평균이 아니라 꼬리(P95·P99) 에서 발생합니다. 그래서 P50("보통 얼마나 빠른가")과 P95("가장 느릴 때 얼마나 느린가")를 함께 보면, 평균 하나로는 놓치는 "빠른 다수"와 "느린 소수"를 분리해 문제가 전체적인지 일부 요청에 국한되는지 즉시 구분할 수 있습니다.

오류율 차트

오류율(%) 라인과 에러 건수 보조 라인을 함께 보여줍니다. 라인 위에 마우스를 올리면 해당 구간의 요청 수가 툴팁으로 표시되어, 오류율이 적은 표본에서 나온 값인지 판단할 수 있습니다.

사용자 만족도(Apdex) 차트

만족·보통·불만 밴드를 배경으로 깐 만족도 라인입니다. 기준 임계값은 3초로 고정되어 있습니다(만족 < 3초, 보통 3~12초, 불만 ≥ 12초).

비교 모드

각 추세 차트에는 번개 아이콘의 비교 모드 드롭다운이 있습니다.

  • 실시간: 현재 추세만 표시(기본).
  • 어제와 비교: 어제 같은 시간대의 값을 겹쳐 표시.
  • 지난주와 비교: 지난주 같은 시간대의 값을 겹쳐 표시.

배포 전후나 요일별 패턴을 비교할 때 활용합니다. 값이 급변하면 차트 제목 옆에 상태 점(초록→주황→빨강)이 나타나 이상 징후를 알립니다.

: 차트 헤더나 우상단의 이동(↗) 버튼을 클릭하면 애플리케이션 상세(SLO 탭 등)로 드릴다운합니다. 필터 범위에 애플리케이션이 둘 이상이면 대상 앱을 먼저 선택하는 다이얼로그가 뜹니다.

트랜잭션 히트맵(T-Map)

트랜잭션 히트맵(T-Map)

트랜잭션 히트맵은 응답시간(세로축)과 시간(가로축)을 격자로 나눠, 각 구간에 들어온 트랜잭션 수를 색 농도로 보여줍니다.

히트맵 읽는 법

  • 각 셀은 일정 시간×응답시간 구간에 속한 트랜잭션 수를 나타냅니다. 색이 진할수록 그 구간의 요청이 많습니다.
  • 빨간 테두리가 있는 셀은 오류가 포함된 구간입니다.
  • 위쪽(응답시간이 높은 영역)에 점이 몰려 있으면 느린 요청이 많다는 뜻입니다.

셀 상호작용

  • 마우스를 올리면 시각 범위, 응답시간 구간, 응답 수, 5xx 오류 수가 툴팁으로 표시됩니다.
  • 셀을 클릭하면 그 구간의 대표 트레이스로 이동해 스팬 단위로 상세를 분석할 수 있습니다.
  • 화살표 키로 셀을 이동하고 Enter로 열 수도 있습니다.
  • 드래그로 시간 범위를 선택하면 트랜잭션 조회 다이얼로그가 열립니다. 이 목록은 선택한 시점의 데이터로 고정되며 실시간과 무관하게 유지됩니다. 다이얼로그가 보여주는 항목은 아래 드릴다운 화면 절에서 자세히 설명합니다.

방향 토글

세 방향(전체·수신·발신)의 데이터가 모두 있을 때 헤더에 방향 토글이 표시됩니다. 앱이 받은 요청(수신)과 앱이 보낸 요청(발신)을 구분해 볼 수 있습니다. 우상단 이동(↗) 버튼을 누르면 분산추적 탭으로 이동합니다.

참고: 분산추적 저장소(ClickHouse)가 구성되지 않은 환경에서는 T-Map이 비활성화되고 안내 문구가 표시됩니다.

실시간 요청 모니터링

화면 하단의 넓은 영역으로, 각 컬럼이 하나의 애플리케이션 인스턴스를 나타냅니다.

컬럼 구성과 정렬

  • 상단에 네임스페이스 밴드가 표시됩니다. 애플리케이션(배포) 이름은 각 컬럼 하단의 인스턴스 라벨에서 확인합니다.
  • 인스턴스 이름을 클릭하면 해당 애플리케이션 상세 화면이 열립니다. 이 위젯을 커스텀 대시보드에 올린 경우에도 동일하게 동작합니다.
  • 정렬은 네임스페이스 → 배포 → 이름 순으로 고정되어, 새로고침해도 인스턴스 위치가 흔들리지 않습니다.
  • 각 컬럼은 대기 중인 요청(pending)을 만족·보통·불만 3색으로 쌓아 보여주며, 요청 낙하 애니메이션은 토글로 켜고 끌 수 있습니다.

컬럼 상세 툴팁

인스턴스 컬럼에 마우스를 올리면 다음 정보가 툴팁으로 표시됩니다.

  • 상태 표시점과 인스턴스 이름(표시 이름을 지정한 경우 원래 이름도 함께)
  • TPS, P50, P95 응답시간
  • 대기 요청(pending) 수와 이를 만족·보통·불만 3구간으로 나눈 내역
  • 중지된 인스턴스는 중지 시각과 사유(메트릭 미수신·노드 다운 등)

표시 이름(별칭) 지정: 네임스페이스·애플리케이션에 알아보기 쉬운 사용자 지정 이름(별칭)을 붙일 수 있습니다. 설정 > 애플리케이션 카테고리 화면에서 별칭을 등록하면, APM 대시보드의 라벨이 원래 식별자 대신 별칭으로 표시됩니다(툴팁에는 원래 이름과 별칭이 함께 표시). 필터·정렬·라우팅은 원래 이름 기준으로 그대로 동작합니다.

중지 상태 표시

메트릭이 수신되지 않는 등으로 중지 판정된 인스턴스는 STOPPED 세로 라벨과 사유(메트릭 미수신·노드 다운·Pod 대기 등)를 함께 표시합니다.

클릭 이동

클릭 대상이동
네임스페이스 이름토폴로지 맵 다이얼로그
컬럼(인스턴스)애플리케이션 상세 다이얼로그
지연(3초 이상) 요청이 있는 컬럼지연 요청 상세

참고: 컬럼은 최대 200개까지 표시됩니다. 초과 시 머리글에 +N 배지가 붙고, 자리가 부족하면 중지된 컬럼부터 숨겨 실시간으로 동작 중인 인스턴스를 우선 표시합니다.

요청 뷰어

요청 뷰어

화면 상단의 요청 뷰어는 현재 처리 상황을 한눈에 보여줍니다.

  • 중앙에 동시 요청 수(in-flight) 를 크게 표시합니다. 아직 응답을 받지 못한 진행 중 요청의 절대값입니다.
  • 좌측에 활성 사용자 수 를 표시합니다.
  • 경과시간 3구간 범례로 진행 중 요청을 나눠 보여줍니다.
구간의미
3초 미만만족 — 정상 범위
3~12초보통 — 다소 느림
12초 이상불만 — 지연 요청

발사효과(파티클) 애니메이션은 토글로 켜고 끌 수 있습니다. 지연(3초 이상) 요청이 있으면 지연 요청 상세 버튼이 나타나, 프로토콜·실행 중인 URL이나 쿼리·목적지·경과시간을 확인할 수 있습니다.

참고: 동시 요청 수는 아웃바운드 대기 요청 기준이며 HTTP/2는 포함하지 않습니다(위젯 툴팁에 명시). 값이 계속 커지는 것처럼 보여도, 스트리밍이나 롱폴링처럼 원래 오래 열려 있는 요청일 수 있습니다.

자원 · 활성 사용자 위젯

  • CPU 사용량(Cores) / 메모리 사용량(RSS): 애플리케이션별 상위 사용량을 라인으로 보여줍니다. 이 두 위젯은 다른 위젯과 달리 메트릭 경로를 사용하므로 약 1분 지연됩니다(엄밀한 실시간이 아님). 카테고리 필터가 적용됩니다.
  • 활성 사용자: 최근 10분 활성 사용자 추세를 보여줍니다. 세션 또는 IP+UA 기준이 함께 표기되며, 이동(↗) 버튼으로 사용자수 추정 화면으로 이동할 수 있습니다.

드릴다운 화면

위젯의 특정 지점을 클릭하거나 드래그하면, 더 자세한 화면(다이얼로그)이 열립니다. 각 화면이 보여주는 항목은 다음과 같습니다.

트랜잭션 조회 다이얼로그

트랜잭션 히트맵(T-Map)에서 시간 범위를 드래그로 선택하면 열립니다. 선택한 구간에 속한 트랜잭션(요청) 목록과, 선택한 요청의 스팬(호출 경로) 상세를 위아래로 보여줍니다.

트랜잭션 조회 다이얼로그 — T-Map 드래그로 선택한 구간의 트랜잭션 목록(위)과 선택한 요청의 스팬 워터폴 상세(아래)

상단 툴바

컨트롤설명
제목 · 선택 범위"트랜잭션 조회"와 선택한 시각·응답시간 범위(예: 10:20:05 → 10:20:25 · 0.2s ~ 1.0s). 응답시간 상한이 없으면
건수조회된 트랜잭션 수. 서버 상한으로 잘리면 "(상위만 표시)" 표기
검색전체 컬럼 텍스트를 대상으로 목록을 필터
스팬 소스 토글eBPF(에이전트 자동 관측) / OTEL(앱 계측) 전환
방향 토글수신 / 발신 (다시 누르면 전체). T-Map의 방향 선택을 이어받음
오류만오류 트랜잭션만 표시

트랜잭션 목록 컬럼

헤더를 클릭하면 정렬됩니다(다시 누르면 역순, 세 번째로 누르면 기본 정렬로 복귀).

컬럼내용
네임스페이스트랜잭션이 속한 네임스페이스
Trace추적(trace) 식별자 색 점과 8자 축약. 같은 추적끼리 색으로 구분(전체 값은 툴팁)
대상 앱요청을 처리한 애플리케이션
방향↓ 수신 / ↑ 발신 (색 구분)
상대수신이면 호출자, 발신이면 목적지 서버
URL요청 URL 또는 이름(전체는 툴팁)
작업유형 뱃지(HTTP·PostgreSQL·Redis·Kafka 등)와 작업명
상태HTTP 상태 코드 또는 OK/ERR (오류는 빨강)
응답시간처리 시간. 3초 이상이면 빨간 굵은 글씨
응답 바이트응답 크기. 페이로드 캡으로 과소 계산됐을 수 있으면 를 붙여 표시
시작시간요청 시작 시각(밀리초까지)

요청 상세(스팬 트리)

목록에서 행을 클릭하면(첫 행은 자동 선택됨) 하단에 그 트랜잭션의 스팬 트리가 표시되어 호출 경로와 각 단계의 소요 시간을 확인할 수 있습니다. 목록이 비어 있으면 "정상 · 트래픽 없음", 행을 고르기 전에는 "행을 선택하면 트랜잭션 상세가 표시됩니다"가 표시됩니다.

참고: 이 다이얼로그는 페이지 나눔 없이 스크롤로 탐색하며, 서버가 한 번에 돌려주는 트랜잭션은 최대 1,000건입니다. 목록은 선택한 시점의 데이터로 고정되어 실시간과 무관합니다.

지연 요청 상세

진행 중인(응답을 아직 받지 못한) 요청 가운데 3초 이상 지연된 요청의 목록입니다. 두 곳에서 열립니다.

  • 요청 뷰어의 지연 요청 상세 버튼 → 범위 전체에서 가장 오래된 요청들(상위 N개).
  • 실시간 요청 모니터링에서 지연 요청이 있는 컬럼을 클릭 → 해당 인스턴스의 지연 요청만.

각 요청은 다음 항목으로 표시됩니다.

컬럼내용
프로토콜HTTP · HTTP/2 · PostgreSQL · MySQL · Oracle · ClickHouse · MongoDB · Redis · Memcached · ZooKeeper 등 색 뱃지
실행 중 URL / 쿼리현재 실행 중인 URL 또는 SQL(바인드 값이 있으면 반영). 복사 버튼 제공
목적지네임스페이스 / 앱 이름(해석된 경우) 또는 IP:포트
경과시간요청이 시작된 뒤 흐른 시간. 구간별 색(3초 미만 초록, 3~12초 주황, 12초 이상 빨강)

지연 요청이 많아 잘린 경우 "지연 N건 중 가장 오래된 M건 표시"가, 없으면 "지연 중인 요청이 없습니다"가 표시됩니다.

참고: 지연 요청 상세는 아웃바운드 대기 요청 기준이며, 이 목록의 요청이 반드시 오류인 것은 아닙니다. 오래 걸리는 쿼리·외부 호출을 실시간으로 포착하는 데 활용합니다.

애플리케이션 상세 다이얼로그

실시간 요청 모니터링에서 컬럼(인스턴스)을 클릭하거나 각 위젯의 이동(↗) 버튼을 누르면 열립니다. 애플리케이션 상세 페이지를 다이얼로그로 옮겨 놓은 화면으로, 다음을 포함합니다.

  • 제목 영역: 애플리케이션 이름과 네임스페이스·종류, 전체 페이지로 열기 버튼.
  • 시간 범위 바: 조회 구간을 표시합니다. 3일을 넘으면 "3일 제한" 배지가 붙고, 의존성 맵을 접고 펼 수 있습니다.
  • 의존성 맵(AppMap): 이 애플리케이션과 연결된 서비스의 관계도.
  • 리포트 탭: 서버가 제공하는 순서대로 SLO · 분산추적(Tracing) · 로그 · 프로파일링 · 보안 등의 탭이 상태 표시등과 함께 나타납니다. 각 탭은 해당 관점의 차트·표를 보여줍니다.
    • 컬럼을 클릭해 열면 기본 탭이, 트랜잭션 맵 위젯의 ↗로 열면 분산추적 탭이, 추세 차트의 ↗로 열면 SLO 탭이 선택됩니다.
  • 보안 탭에서는 공격 IP 목록(IP·국가·도시·횟수)과 예외 설정을 볼 수 있고, SLO·분산추적 탭의 히트맵을 드래그하면 다시 트랜잭션 조회로 드릴다운할 수 있습니다.

: 애플리케이션 상세 다이얼로그의 각 탭이 무엇을 보여주는지는 애플리케이션 문서의 "리포트 탭" 절에서 자세히 설명합니다.

실시간 데이터의 특성

APM 대시보드는 위젯마다 데이터를 보는 시간 창이 다릅니다.

위젯시간 창
요청 뷰어 · 요청 모니터링(파티클/게이지)실시간 약 90초 창
추세 차트(TPS·응답시간·오류율·만족도)최근 10분(10초 버킷)
트랜잭션 히트맵(T-Map)최근 10분 창
CPU · 메모리메트릭 경로(약 1분 지연)

핵심은 이 화면이 라이브 L7 요청을 근거로 한다는 점입니다. 따라서 트래픽이 발생하지 않은 초·애플리케이션·네임스페이스는 화면에 나타나지 않습니다. 각 위젯은 트래픽이 없을 때 "정상 · 트래픽 없음"으로 표시합니다. node-agent가 배포되지 않은 환경에서는 실시간 데이터가 없다는 안내가 표시됩니다.

활용 시나리오

배포 직후 반응 확인

  1. 배포한 애플리케이션이 속한 카테고리·네임스페이스로 필터를 좁힙니다.
  2. 정보 카드에서 오류율과 응답시간(P50/P95)이 배포 전 수준을 유지하는지 확인합니다.
  3. 오류율 차트의 비교 모드를 어제와 비교로 두어, 같은 시간대 대비 오류가 늘지 않았는지 봅니다.
  4. 실시간 요청 모니터링에서 새 인스턴스가 STOPPED 없이 정상적으로 요청을 받고 있는지 확인합니다.

느린 요청 원인 찾기

  1. 응답시간 차트에서 P95가 튄 시각을 확인합니다.
  2. 트랜잭션 히트맵(T-Map) 에서 그 시각의 위쪽(높은 응답시간) 영역을 드래그해 트랜잭션 조회 다이얼로그를 엽니다.
  3. 느린 트랜잭션을 골라 셀을 클릭분산추적으로 이동, 스팬 폭포수에서 가장 오래 걸린 구간을 찾습니다.
  4. 요청 뷰어에 지연 요청이 잡혀 있으면 지연 요청 상세에서 실행 중인 URL·목적지를 확인합니다.

오류 급증 대응

  1. 정보 카드의 오류율 셀이 빨간색으로 바뀐 것을 확인합니다.
  2. 오류율 차트에서 급증 시각과 에러 건수를 파악합니다.
  3. T-Map에서 빨간 테두리 셀(오류 포함 구간)을 클릭해 대표 트레이스로 이동, 예외·상태 코드를 확인합니다.
  4. 특정 인스턴스에서만 오류가 나면 실시간 요청 모니터링에서 해당 컬럼을 클릭해 애플리케이션 상세로 들어갑니다.

특정 인스턴스 자원 확인

  1. CPU 사용량 / 메모리 사용량 위젯에서 사용량이 튄 애플리케이션을 확인합니다(약 1분 지연 반영).
  2. 실시간 요청 모니터링에서 그 애플리케이션 컬럼의 대기 요청(pending) 색 분포를 봅니다.
  3. 컬럼을 클릭해 애플리케이션 상세로 이동, 자원과 요청을 함께 분석합니다.

자주 묻는 질문

특정 네임스페이스/애플리케이션이 화면에 안 보입니다

APM 대시보드는 라이브 L7 요청을 근거로 하므로, 트래픽이 발생한 대상만 표시됩니다. 트래픽이 없어 목록에 안 보이는 것은 오류가 아닙니다. 트래픽이 없어도 앱 목록 자체를 보려면 애플리케이션 화면을 사용하세요. 이 화면은 워크로드·Pod 존재를 기반으로 하므로 트래픽이 없어도 앱이 표시됩니다.

값이 잠깐 오래된 것처럼 보입니다

상단에 집계 지연 배지가 떠 있는지 확인하세요. 서버 집계가 연속으로 지연되면 이 배지가 표시되며, 데이터가 잠시 오래된 값일 수 있습니다. 또한 실시간 요청 창의 마지막 몇 초는 집계 완결을 위해 아직 화면에 반영되지 않을 수 있습니다.

CPU/메모리 위젯만 반응이 느립니다

CPU·메모리 위젯은 다른 위젯과 달리 메트릭 경로를 사용하므로 약 1분 지연됩니다. 이는 정상 동작이며, 요청량·응답시간 같은 실시간 위젯과는 갱신 주기가 다릅니다.

과거 시점을 조회하고 싶습니다

APM 대시보드는 실시간 전용 화면이라 시작·종료 시간 선택기가 없습니다. 과거 구간 분석은 애플리케이션 상세, 분산추적 히트맵, 인시던트 등 시간 범위를 지정할 수 있는 화면을 사용하세요.

동시 요청 수(in-flight)가 계속 늘어납니다

동시 요청 수는 아웃바운드 대기 요청 기준이며 HTTP/2는 포함하지 않습니다. 스트리밍·롱폴링·구독형 요청처럼 원래 오래 열려 있는 요청은 지연이 아니어도 in-flight로 잡힐 수 있습니다. 실제 지연 여부는 요청 뷰어의 경과시간 구간과 지연 요청 상세로 확인하세요.

실시간 데이터가 아예 표시되지 않습니다

node-agent가 배포되어 있는지 확인하세요. eBPF 기반 L7 관측은 node-agent가 수집하므로, 에이전트가 없으면 실시간 데이터가 없다는 안내가 표시됩니다. 설치는 설치 가이드를 참고하세요.

용어

용어설명
APMApplication Performance Monitoring — 애플리케이션 성능 모니터링
L7 요청(스팬)eBPF가 관측한 애플리케이션 계층(HTTP·gRPC·DB 등) 요청 단위 기록
트랜잭션하나의 요청 처리 단위. 히트맵·트랜잭션 조회의 집계 단위
TPSTransactions Per Second — 초당 트랜잭션(요청) 수
P50 / P95응답시간 백분위수. P50은 중앙값, P95는 상위 5% 경계(느린 쪽)
오류율전체 요청 대비 오류 요청 비율(%)
동시 요청(in-flight)아직 응답을 받지 못한 진행 중 요청 수(아웃바운드 대기 기준)
사용자 만족도(Apdex)응답시간 만족도 지표. 임계값 3초 기준(만족·보통·불만)
활성 사용자최근 트래픽에서 추정한 사용자 수(Session 또는 IP+UA 기준)
방향(수신/발신)앱이 받은 인바운드 vs 앱이 보낸 아웃바운드 트래픽
STOPPED메트릭 미수신 등으로 중지 판정된 인스턴스 표시

관련 문서

  • 애플리케이션 -- 트래픽이 없어도 표시되는 앱 목록과 과거 구간 상세 분석
  • 분산추적 -- T-Map 셀에서 이어지는 스팬 폭포수 및 추적 상세
  • 사용자수 추정 -- 활성 사용자 산정 방식(Session / IP+UA)과 지역 분포
  • 토폴로지 맵 -- 네임스페이스 클릭 시 열리는 서비스 의존성 맵
  • 커스텀 대시보드 -- 공유되는 네임스페이스 선택과 사용자 정의 지표 화면
  • 설정 -- 응답 시간 SLO 목표 및 검사 조건 설정