2개의 글
로컬 LLM 스택을 하드웨어(VRAM 중심 의사결정)와 오케스트레이션(LangChain·LangGraph 역할 분리) 두 계층으로 정리합니다.
키워드 검색(BM25)과 벡터 검색(Faiss·OpenSearch)을 RRF로 결합하는 하이브리드 검색 파이프라인을 수식부터 구현, 튜닝까지 한 편에 정리합니다.