OpenSearch 플러그인
OpenSearch 플러그인은 OpenSearch 클러스터를 Konduo 리소스로 등록하고 클러스터 상태, 노드, 샤드, 인덱스, JVM, 스레드 풀, 검색/색인 신호를 운영 화면에 연결합니다.
특징
- HTTP API 기반 상태 점검과 진단으로 클러스터 상태를 확인합니다.
- Prometheus 매핑팩으로 익스포터 메트릭을 논리 메트릭에 연결합니다.
- 대시보드는 클러스터 상태, 인덱스 상태, 샤드 이동, 색인/검색 처리량, JVM/GC 압박, 디스크 워터마크, 스레드 풀 대기열/거부를 중심으로 구성됩니다.
- 진단은 접속, 인증, 메트릭 수집 범위, 샤드/인덱스 위험, JVM/디스크 압박, 스냅샷 저장소 준비 상태를 분리해 보여줍니다.
등록 전 확인
- OpenSearch 엔드포인트, 인증 정보, TLS 검증 정책, 제한 시간을 준비합니다.
- 메트릭 대시보드를 쓰려면 익스포터 수집과 라벨 필터를 먼저 확인합니다.
- 읽기 전용 운영 계정으로 클러스터 상태, cat/index, node stats, snapshot repository API를 조회할 수 있어야 합니다.
운영 팁
yellow/red상태는 샤드 배치, 디스크 워터마크, 노드 가용성과 함께 확인합니다.- JVM 힙 압박과 GC, 검색/색인 지연, 스레드 풀 거부는 연쇄적으로 나타날 수 있습니다.
- 미할당/초기화/재배치 중인 shard와 red/yellow 인덱스 수를 같이 보면 복구 중인 상태와 실제 위험을 구분하기 쉽습니다.
- 파괴적 인덱스 작업이나 임의 쿼리 실행은 현재 CE 운영 경계가 아닙니다.
운영 화면
- 클러스터 화면은 상태, 노드 수, 샤드 상태, 이동/초기화 중인 샤드, master eligible 근거를 보여줍니다.
- 인덱스와 샤드 화면은 인덱스 상태, 샤드 배치, 복제본 위험, 미할당 인덱스 수를 읽기 전용으로 제공합니다.
- 리소스 압박 화면은 JVM 힙, GC, 디스크 워터마크 low/high/flood-stage posture를 함께 확인하게 합니다.
- 스냅샷 저장소 화면은
GET /_snapshot근거로 저장소 수, 유형, 샘플 저장소 이름을 표시합니다. - 메트릭 대시보드는 인덱스 상태 수, shard movement, GC 수집 속도, disk watermark 노드 수, 검색/인덱싱 지연, threadpool queue/reject를 함께 제공합니다.
- 진단은 클러스터 API 근거와 메트릭 소스 근거를 분리해서 API 접근 문제와 성능 위험을 구분합니다.
진단과 알림 관점
- 진단은 연결성, 인증, 클러스터 상태, 샤드 배치, 인덱스 상태, JVM/디스크 압박, 스냅샷 저장소, 스레드 풀 거부, 메트릭 수집 범위를 나눠 표시합니다.
- 알림 규칙은 클러스터 상태 악화, 미배치 샤드, JVM 힙 압박, 스레드 풀 거부, 색인/검색 압박을 중심으로 합니다.
- 익스포터 메트릭 라벨은 클러스터, 노드, 인덱스 단위가 섞일 수 있으므로 매핑팩 적용 후 패널 수집 범위와 라벨 필터를 확인해야 합니다.
yellow상태는 즉시 장애가 아닐 수 있지만 복제본 안전성과 노드/디스크 상태를 함께 보면 위험도를 판단할 수 있습니다.
관리 경계
- CE 플러그인은 인덱스 삭제, 닫기/열기, 강제 병합, 스냅샷 복원 같은 파괴적 작업을 제공하지 않습니다.
- 임의 검색/쿼리 실행, 로그 검색, 로그 근거 수집, 상관 분석은 CE 운영 진단 범위 밖이며 EE overlay에서 다룹니다.
- 읽기 전용 API 권한 부족은 부분 근거로 표현되며, 메트릭이 정상이어도 API 상태 권한 문제는 별도로 처리해야 합니다.
- 보안 설정, 역할 매핑, 인덱스 템플릿 변경은 현재 플러그인 관리 경계 밖입니다.
대표 시나리오
- 클러스터 상태가
yellow또는red이면 미배치 샤드, 노드 가용성, 디스크 워터마크, 복제본 수를 순서대로 확인합니다. - 검색 지연이 증가하면 검색 스레드 풀 대기열/거부, 힙/GC, 고부하 인덱스, 쿼리 트래픽 변화를 함께 봅니다.
- 색인 지연이 증가하면 색인 비율, 갱신/병합 압박, 디스크 IO, 트랜잭션 로그 상태를 같이 봅니다.
- 샤드 불균형이 의심되면 인덱스별 샤드 크기와 노드별 디스크 압박을 함께 확인합니다.
OpenSearch Enterprise 확장
OpenSearch Enterprise 확장은 OpenSearch 리소스를 Enterprise 로그 소스 제공자로 확장합니다. MCP 설명자, 로그 쿼리 검증, 필드 카탈로그, 로그 근거 매핑, 진단, 이상 징후 규칙을 통해 운영 로그를 장애 분석 흐름에 연결합니다.
특징
- MCP에서 로그 소스 프로필, 필드 카탈로그, 매핑팩, 진단, 알림/이상 징후 규칙을 제공합니다.
- 제한된 로그 검색, 이벤트 주변 조회, 쿼리 해석, 로그 근거 수집, 상관 요약, 진단 이력 조회를 지원합니다.
- 로그 근거 매핑은 Redis, PostgreSQL 등 다른 리소스 진단과 로그 소스를 연결합니다.
- 민감 정보처럼 보이는 메시지 조각을 노출하지 않도록 로그 경로는 제한된 시간 범위와 결과 수를 사용합니다.
CE 기반 운영 진단
- Community 기반 화면은 클러스터 상태, shard allocation, 인덱스 상태, JVM/GC 압박, 디스크 watermark, thread-pool queue/reject, 검색/색인 지연, 스냅샷 저장소 준비 상태를 읽기 전용 근거로 제공합니다.
- EE overlay는 이 운영 진단을 대체하지 않고, 같은 진단 키에 맞는 로그 근거와 메트릭/로그 상관 모델을 추가합니다.
등록 전 확인
- OpenSearch 엔드포인트, 인덱스 패턴, 인증, TLS 설정을 준비합니다.
- 로그 소스로 사용할 필드 매핑과 타임스탬프 필드를 확인합니다.
- MCP와 로그 쿼리 권한이 필요한 운영자에게만 부여되도록 RBAC를 점검합니다.
운영 팁
- 장애 근거 검색은 짧은 조회 범위와 명확한 리소스 맥락으로 시작합니다.
- OpenSearch 이상 징후 규칙은 메트릭 소스 기반이며, 로그 근거는 분석 맥락으로 연결합니다.
운영 시나리오
- Redis, PostgreSQL, Kafka 같은 리소스 진단에서 나온 시간대와 리소스 식별자를 로그 근거 매핑으로 OpenSearch 검색에 연결합니다.
- 장애 전후 로그를 볼 때 이벤트 주변 조회와 필드 카탈로그를 사용해 쿼리를 좁히고, 과도한 범위 검색을 피합니다.
logs/evidence와correlation/summary를 사용해 shard allocation, JVM GC, disk watermark, thread-pool reject 같은 진단 키별 로그/메트릭 근거를 같은 묶음으로 확인합니다.- MCP 로그 설명자는 에이전트가 로그 근거를 요청할 수 있게 하지만 시간 범위, 결과 수, 마스킹 경계를 유지합니다.
경계
- OpenSearch는 EE 로그 소스 제공자이며, 로그 조회는 제한된 읽기 전용 업무 흐름으로 제한합니다.
- 로그 근거는 이상 징후 평가 자체를 대체하지 않고, 메트릭 기반 이상 징후와 진단 결과를 설명하는 문맥으로 연결합니다.