Posts
작성한 모든 글입니다.
vLLM에서 llama.cpp로: LLM 서빙 아키텍처 통합 마이그레이션
수정일:vLLM Ray Serve 분산 구조에서 통합 모델 서빙 서비스로 마이그레이션한 과정. 백엔드 스위칭 매니저 설계, llama.cpp와 vLLM 런타임 전환까지.
XGEN K3s 인프라 완전 해부 (1) — 전체 구조와 컨테이너 빌드 전략
수정일:XGEN 2.0 AI 에이전트 플랫폼의 K3s 기반 인프라를 처음부터 끝까지 해부한다. 1편에서는 전체 아키텍처 구조, Python/Rust/Node.js 4종 Dockerfile 멀티스테이지 빌드 전략, Docker Compose 인프라 스택, K8s-Docker 경계 연결 패턴을 다룬다.
Pagefind + synaptic-memory 하이브리드 검색: 블로그 검색을 검색엔진 포트폴리오로 만들기
수정일:SON BLOG 검색을 Pagefind 정적 전문 검색, synaptic-memory 의미 검색, 한국어 형태소 분석, alias 사전, confidence gate, 평가셋과 blue/green 배포까지 갖춘 하이브리드 검색 구조로 고도화한 과정을 정리한다.
보험 광고 영상을 AI로 검사하기: OCR, STT, RAG, 객체 탐지를 묶은 심의 QA 파이프라인
수정일:보험 광고 영상의 필수 고지, 음성 안내, 금지표현, 금지 이미지, 자막 위치 요건을 OCR, STT, RAG, 객체 탐지, LLM 판정으로 자동 점검한 POC 과정을 정리한다.