Prometheus 플러그인
Prometheus 플러그인은 Konduo가 Prometheus 호환 HTTP API에서 시계열 데이터를 조회하고, 다른 리소스 플러그인의 논리 메트릭을 PromQL 쿼리로 실행할 수 있게 하는 메트릭 소스 플러그인입니다.
특징
- 리소스 대시보드와 알림 평가에 필요한 범위/즉시 쿼리를 실행합니다.
- 라벨 탐색, 쿼리 점검, 매핑팩 적용 상태 확인을 지원합니다.
- Prometheus 서버 자체를 리소스로 등록해 수집 대상 상태, TSDB, 규칙/평가, 런타임 신호를 볼 수 있습니다.
- 재적재, 스냅샷 같은 Prometheus 관리 작업은 설정과 확인 문구, 대기 시간으로 보호됩니다.
등록 전 확인
- Konduo 백엔드에서 Prometheus HTTP API에 접근할 수 있어야 합니다.
- URL, 인증 방식, 제한 시간, 쿼리 제한 정책을 준비합니다.
- 이 Prometheus 인스턴스를 관리형 메트릭 수집의 쓰기 대상으로 사용할 경우
--web.enable-remote-write-receiver옵션으로 실행해야 합니다. - 리소스 플러그인의 매핑팩을 적용해야 대시보드와 알림 규칙이 기대한 논리 메트릭을 찾을 수 있습니다.
운영 팁
- 대시보드가 비어 있으면 수집 상태, 라벨 필터, 매핑팩 적용 여부를 같이 확인합니다.
- 쿼리 범위와 간격은 과도한 샘플을 만들지 않도록 제한합니다.
- Prometheus 수집 대상 상태는 대상 리소스의 직접 가용성을 대체하지 않고 메트릭 근거로 사용합니다.
운영 화면
- 메트릭 소스 화면은 Prometheus HTTP API 연결, 라벨 탐색, 쿼리 점검, 매핑팩 상태를 확인하는 진입점입니다.
- Prometheus 리소스 화면은 Prometheus 자체의 수집 대상, 규칙 그룹, 알림 상태, TSDB, 런타임 상태를 보여줍니다.
- 기본 대시보드는 대상 정상 비율과 처리량 외에도 스크레이프당 수락 샘플, 쿼리 평가 시간, TSDB 블록/WAL 저장공간, 규칙 평가 시간을 시계열로 보여줍니다.
- 쿼리/규칙 평가 시간은 최근 5분 평균입니다. 쿼리 속도 및 규칙 실행 간격과 함께 비교하고, TSDB 저장공간은 보존 기간과 compaction 상태를 함께 확인합니다.
- Prometheus 호환 백엔드가 Prometheus 자체 메트릭 이름을 제공하지 않으면 새 선택 메트릭 패널은 데이터 없음으로 표시될 수 있지만 매핑팩 검증은 실패하지 않습니다.
- 매핑팩 화면은 리소스 플러그인의 논리 메트릭 키가 어떤 PromQL로 해석되는지 확인하는 데 사용합니다.
- 쿼리 점검은 대시보드가 비었거나 알림 평가가 부분 상태일 때 실제 쿼리와 라벨 조건을 점검하는 도구입니다.
진단과 알림 관점
- Prometheus 플러그인은 다른 리소스의 메트릭 근거를 제공하는 기반이므로 수집 대상 상태, 수집 지연, 규칙 평가 상태가 중요합니다.
- 진단은 HTTP API 연결, 수집 대상 상태, 규칙 평가, 활성 알림, TSDB/런타임 압박, 매핑 범위를 분리해서 보여줍니다.
- Prometheus 자체 알림은 메트릭 플랫폼 위험을 다루고, Redis/Kafka/PostgreSQL 같은 대상 리소스의 장애 판정은 해당 플러그인과 Core 가용성이 담당합니다.
- 샘플 수가 과도하거나 쿼리가 느린 경우에는 범위, 간격, 라벨 필터, 대시보드 패널 수를 함께 조정해야 합니다.
관리 경계
- reload와 snapshot은 운영 영향이 있는 관리 작업이므로 확인 문구와 대기 시간을 유지합니다.
- 임의 PromQL 쿼리 기능은 운영 점검용이며, 장시간/고비용 쿼리를 실행하는 일반 분석 도구로 확장하지 않습니다.
- 관리형 수집의 쓰기 대상으로 사용할 때도 Prometheus는 샘플 저장소이며, 수집 주기와 대상 시스템 접근은 각 리소스 플러그인과 Core가 담당합니다.
- 매핑팩 오버라이드는 메트릭 키 차이를 흡수하는 수단이며, 리소스 상태를 임의로 정상화하는 우회 수단이 아닙니다.
대표 시나리오
- 리소스 대시보드가 비어 있으면 Prometheus 수집 대상 상태, 라벨 필터, 매핑팩 적용 여부, 쿼리 점검 결과를 순서대로 확인합니다.
- 알림 평가가 부분 상태이면 해당 논리 메트릭의 PromQL과 실제 시계열 라벨을 비교합니다.
- Prometheus 부하가 높으면 규칙 평가 지연, 쿼리 동시성, TSDB head block, 수집 간격을 함께 봅니다.
- 관리형 수집 샘플이 보이지 않으면 원격 쓰기 수신 옵션, Core 쓰기 상태, 리소스 식별 라벨을 확인합니다.
Prometheus Enterprise 확장
Prometheus Enterprise 확장은 메트릭 소스 리소스에 MCP 설명자와 Prometheus 자체 원격 측정 이상 징후 규칙을 추가합니다. 수집, 적재, 카디널리티, 쿼리 압박을 분석해 메트릭 플랫폼 자체의 위험을 감지합니다.
특징
- MCP에서 Prometheus 리소스 메타데이터, 진단, 메트릭 카탈로그, 이상 징후 규칙을 조회합니다.
- 선언형 메트릭 규칙은 수집 시간, 적재율, TSDB head series, 쿼리 비율 같은 논리 메트릭을 사용합니다.
- 시뮬레이터 시계열로 카디널리티와 적재 압박 시나리오를 검증합니다.
- Prometheus는 메트릭 제공자 역할을 유지하며 플러그인 모드 탐지기를 실행하지 않습니다.
등록 전 확인
- Prometheus API 엔드포인트와 쿼리 권한이 정상이어야 합니다.
- Prometheus 자체 메트릭을 수집하는 매핑팩을 연결합니다.
- MCP 사용자는 메트릭 소스 읽기 권한과 필요한 범위를 가져야 합니다.
운영 팁
- 카디널리티 증가는 익스포터, 라벨, 계측 변경과 함께 추적합니다.
- 수집 지연과 적재 압박이 같이 올라가면 대상 증가와 원격 쓰기 상태를 함께 확인합니다.
- 기본 대시보드는 대상 정상 비율과 처리량 외에도 스크레이프당 수락 샘플, 쿼리 평가 시간, TSDB 블록/WAL 저장공간, 규칙 평가 시간을 시계열로 보여줍니다.
- 쿼리/규칙 평가 시간은 최근 5분 평균입니다. 쿼리 속도 및 규칙 실행 간격과 함께 비교하고, TSDB 저장공간은 보존 기간과 compaction 상태를 함께 확인합니다.
- Prometheus 호환 백엔드가 Prometheus 자체 메트릭 이름을 제공하지 않으면 새 선택 메트릭 패널은 데이터 없음으로 표시될 수 있지만 매핑팩 검증은 실패하지 않습니다.
운영 시나리오
- Prometheus가 여러 리소스의 메트릭 소스일 때 수집 상태, 대상 변동, TSDB 카디널리티, 쿼리 압박을 먼저 확인해 관측 체계 자체의 신뢰도를 판단합니다.
- 특정 플러그인의 이상 징후가 갑자기 사라지거나 많아지면 Prometheus 매핑팩과 소스 원격 측정 상태를 함께 점검합니다.
- MCP 설명자는 메트릭 플랫폼 상태를 에이전트가 빠르게 확인하는 읽기 전용 카탈로그로 사용합니다.
경계
- Prometheus 플러그인은 메트릭 제공자이자 관측 대상이며, 플러그인 모드 이상 징후 탐지기를 실행하지 않습니다.
- 기록 규칙, 수집 설정, 원격 쓰기 설정 변경은 Prometheus 운영 경계에 속하며 이 확장 계층이 직접 변경하지 않습니다.