2026.09.06 접속자 18
로그인 회원가입
HOT
[프롬프트] LLM한테 코드 리뷰 받을 때 유용한 프롬프트 공유합니다 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 뭐 쓰세요? [AI뉴스] 2026년 하반기 AI 뉴스 정리... 요즘 AI 시장 어디까지 왔나요? [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] 요즘 LLM 파인튜닝 비용이 얼마나 드세요? [AI뉴스] 요즘 회사에서 AI 도입하라고 하는데 실제로 제대로 쓰는 곳이 몇이나 될까요? [프롬프트] Claude에게 "역할극" 시키는 프롬프트 꿀팁 [AI뉴스] 요즘 오픈소스 AI 모델들 미친 수준으로 빠르게 출시되고 있네요 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 것들 [기술 Q&A] LLM 파인튜닝할 때 LoRA랑 QLoRA 중 뭐 써야 하나요? [프롬프트] LLM한테 코드 리뷰 받을 때 유용한 프롬프트 공유합니다 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 뭐 쓰세요? [AI뉴스] 2026년 하반기 AI 뉴스 정리... 요즘 AI 시장 어디까지 왔나요? [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] 요즘 LLM 파인튜닝 비용이 얼마나 드세요? [AI뉴스] 요즘 회사에서 AI 도입하라고 하는데 실제로 제대로 쓰는 곳이 몇이나 될까요? [프롬프트] Claude에게 "역할극" 시키는 프롬프트 꿀팁 [AI뉴스] 요즘 오픈소스 AI 모델들 미친 수준으로 빠르게 출시되고 있네요 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 것들 [기술 Q&A] LLM 파인튜닝할 때 LoRA랑 QLoRA 중 뭐 써야 하나요?
API연동

최근에 RAG 구현하면서 느낀 건데 벡터 DB 선택이 생각보다 중요하네요

딥러너 2026.05.04 06:15 조회 286 추천 14 댓글 1건
프로젝트에서 RAG 시스템 만들어봤는데 처음엔 그냥 Pinecone으로 대충 시작했거든요. 그런데 데이터 규모가 커지니까 비용이 장난 아니더라고요. 그래서 로컬에서 Milvus로 갈아탔는데 확실히 달라요.

특히 재현율(recall) 차이가 신경 쓰였어요. 벡터 임베딩 모델도 중요하지만 DB의 인덱싱 방식에 따라 검색 정확도가 꽤 달라지더라고요. 근데 운영 복잡도는 Milvus가 훨씬 높은 게 단점이긴 합니다.

혹시 프로덕션 환경에서 RAG 운영하시는 분들 계신가요? 어떤 벡터 DB 쓰시는지, 그리고 임베딩 모델은 뭐 선택하셨는지 궁금해요. 한국어 데이터 다루실 때 특별히 신경 써야 할 게 있으면 팁 공유해주세요.
추천 14 비추천 0
댓글 1

댓글목록

profile_image
GPT덕후하나
저도 비슷한 경험했는데 Pinecone 비용이 진짜 무섭더라고요 ㅋㅋ 저는 결국 Weaviate로 셀프 호스팅하게 됐어요. Milvus도 좋다고 들었는데 운영 복잡도가 있군요.
한국어는 임베딩 모델 선택이 정말 중요한데, 저는 ko-sbert보다 bge-m3이 재현율이 더 좋더라고요. 특히 한국어 특화 모델들이 일반 임베딩보다 훨씬 나으니 꼭 시도해보세요. 인덱싱은 HNSW 방식이 대부분 문제없는데 데이터 규모가 어느 정도인가요?