2026.10.03 접속자 31명
로그인 회원가입
HOT
[AI뉴스] 이제 AI는 그냥 기술이 아니라 인프라라더군요 [AI뉴스] 2025년에 나온 LLM 모델들 정리해봤는데 진짜 많네요 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 패턴 공유합니다 [자유게시판] 편의점 야간알바 3개월 후기 [프롬프트] AI한테 물어볼 때 이렇게 프롬프트 짜면 답변이 확 달라져요 [자유게시판] 요즘 혼자 밥 먹을 때 뭐 하세요? [프롬프트] ChatGPT 실무에서 쓰는 프롬프트 패턴 정리해봤습니다 [자유게시판] 편의점 카페인음료 가성비 최고는 뭐가 있을까요? [자유게시판] 편의점 계란 가격 진짜 미쳤네요 [자유게시판] 요즘 직장 다니면서 취미생활 하시는 분 계신가요? [AI뉴스] 이제 AI는 그냥 기술이 아니라 인프라라더군요 [AI뉴스] 2025년에 나온 LLM 모델들 정리해봤는데 진짜 많네요 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 패턴 공유합니다 [자유게시판] 편의점 야간알바 3개월 후기 [프롬프트] AI한테 물어볼 때 이렇게 프롬프트 짜면 답변이 확 달라져요 [자유게시판] 요즘 혼자 밥 먹을 때 뭐 하세요? [프롬프트] ChatGPT 실무에서 쓰는 프롬프트 패턴 정리해봤습니다 [자유게시판] 편의점 카페인음료 가성비 최고는 뭐가 있을까요? [자유게시판] 편의점 계란 가격 진짜 미쳤네요 [자유게시판] 요즘 직장 다니면서 취미생활 하시는 분 계신가요?
활용법

로컬 LLM 돌려보니 생각보다 쓸만하네요

현실주의자 2026.10.03 21:37 조회 1 추천 0 댓글 0건
요즘 클라우드 API 비용이 미치도록 올라가서 로컬로 돌릴 수 있는 모델들 좀 찾아봤어요. 8GB 그래픽카드에 Llama 2 7B를 Ollama로 돌려봤는데 생각보다 괜찮더라고요. 물론 GPT-4 수준은 아니지만 코드 리뷰나 문서 작성 같은 작업은 충분히 해줍니다.

다만 첫 응답까지 걸리는 시간이 조금 길긴 해요. 배치 크기를 줄이니까 좀 나아졌는데 여전히 몇 초는 걸립니다. 그리고 VRAM 관리를 제대로 안 하면 OOM이 뜨니까 그 부분만 신경 쓰면 될 것 같아요.

혹시 같은 환경에서 더 최적화된 세팅 써보신 분 계신가요? quantized 모델 추천도 받고 싶습니다.
추천 0 비추천 0
댓글 0

댓글목록

아직 댓글이 없습니다. 첫 댓글을 남겨보세요!