2026.09.22 접속자 46
로그인 회원가입
HOT
[AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요 [자유게시판] 요즘 커피 중독인데 이게 정상인가요 [자유게시판] 요즘 직장인들 퇴근 후에 뭐 하면서 시간 보내세요? [AI뉴스] 최근 LLM 모델들 정리해봤는데 진짜 미친 속도로 늘어나네요 [프롬프트] 코드 리뷰 프롬프트 효과본 누계 있으세요? [AI뉴스] GPT-6 Astra 나왔다는데 동시에 ChatGPT 먹통? 이게 뭐하는 짓인지 모르겠네요 [AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요 [자유게시판] 요즘 커피 중독인데 이게 정상인가요 [자유게시판] 요즘 직장인들 퇴근 후에 뭐 하면서 시간 보내세요? [AI뉴스] 최근 LLM 모델들 정리해봤는데 진짜 미친 속도로 늘어나네요 [프롬프트] 코드 리뷰 프롬프트 효과본 누계 있으세요? [AI뉴스] GPT-6 Astra 나왔다는데 동시에 ChatGPT 먹통? 이게 뭐하는 짓인지 모르겠네요
오류해결

Llama 3.1 405B 로컬에서 돌려봤는데 생각보다네요

흐름타는개발자 2026.09.17 08:33 조회 34 추천 4 댓글 0건
얼마 전에 Llama 3.1 405B를 로컬 머신에서 한번 굴려봤습니다. vLLM으로 양자화(INT8)해서 돌렸는데, 확실히 GPT-4 수준의 추론 능력이 있다는 평가가 맞는 것 같더라고요. 특히 코딩 태스크에서 Claude 3.5 Sonnet과 비슷한 수준의 결과물이 나오는 게 신기했습니다.

다만 메모리가 정말 장난 아니네요. A100 80GB 한 장으로는 부족해서 결국 2장을 써야 했거든요. 응답 속도도 API 기반 모델들에 비하면 느릴 수밖에 없고요. 오픈소스 모델의 자유도는 좋지만 프로덕션 환경에서는 비용-성능 트레이드오프를 진짜 잘 따져봐야 할 것 같습니다.

혹시 더 효율적으로 돌리는 방법 아시는 분 있으면 팁 좀 나눠주시면 감사하겠습니다.
추천 4 비추천 0
댓글 0

댓글목록

아직 댓글이 없습니다. 첫 댓글을 남겨보세요!