태그: 검색엔진
이 태그가 달린 글 "검색엔진".
OpenSearch ML 모델 배포 시 메모리 99% 점유 원인과 해결법
OpenSearch에 Hugging Face 임베딩 모델을 배포한 후 메모리가 급격히 차오르는 원인을 분석한다. ML Commons 기반 추론의 모델 크기, JVM 힙, 동시 요청 처리, 노드 역할 분리 등 해결 전략을 정리한다.
OpenSearch 설치 및 빌드를 위한 서버 자원 확인 절차
OpenSearch 설치 전 필요한 서버 자원 점검 명령어를 정리한다. CPU, 메모리, 디스크, 커널 파라미터, Docker 환경, GPU 자원 등 안정적인 운영을 위해 확인해야 할 항목과 명령어를 다룬다.
단일 서버에서 OpenSearch 최적 배포 — 노드 역할 분리와 자원 격리
단일 서버에서 Docker Compose로 OpenSearch를 배포할 때 ML 노드 역할 분리와 자원 격리를 구현하는 방법을 정리한다. 데이터 노드와 ML 전용 노드를 분리하여 벡터 임베딩 기능을 안정적으로 운영하는 전략을 다룬다.
OpenSearch 성능 벤치마크와 TPS별 서버 구성 가이드
OpenSearch의 워크로드별 성능 벤치마크와 TPS 기준 서버 구성 사례를 정리한다. Trail of Bits 테스트 결과, CPU/RAM 사양별 권장 구성, GPU 노드 활용 시나리오를 다룬다.