2026.09.06 접속자 89
로그인 회원가입
HOT
[AI뉴스] 요즘 딥러닝 논문들 어떤 방향으로 가고 있는지 궁금하네요 [프롬프트] LLM한테 코드 리뷰 받을 때 유용한 프롬프트 공유합니다 [AI뉴스] 요즘 AI 산업 변화 좀 충격적이던데 다들 어떻게 생각하세요? [AI뉴스] 2026년 하반기 AI 뉴스 정리... 요즘 AI 시장 어디까지 왔나요? [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 뭐 쓰세요? [프롬프트] Claude에게 "역할극" 시키는 프롬프트 꿀팁 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] 요즘 LLM 파인튜닝 비용이 얼마나 드세요? [AI뉴스] 요즘 회사에서 AI 도입하라고 하는데 실제로 제대로 쓰는 곳이 몇이나 될까요? [기술 Q&A] RAG 시스템 구축할 때 Vector DB 선택 기준이 뭔가요? [AI뉴스] 요즘 딥러닝 논문들 어떤 방향으로 가고 있는지 궁금하네요 [프롬프트] LLM한테 코드 리뷰 받을 때 유용한 프롬프트 공유합니다 [AI뉴스] 요즘 AI 산업 변화 좀 충격적이던데 다들 어떻게 생각하세요? [AI뉴스] 2026년 하반기 AI 뉴스 정리... 요즘 AI 시장 어디까지 왔나요? [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 뭐 쓰세요? [프롬프트] Claude에게 "역할극" 시키는 프롬프트 꿀팁 [프롬프트] 코드 리뷰 요청할 때 쓰는 프롬프트 공유합니다 [기술 Q&A] 요즘 LLM 파인튜닝 비용이 얼마나 드세요? [AI뉴스] 요즘 회사에서 AI 도입하라고 하는데 실제로 제대로 쓰는 곳이 몇이나 될까요? [기술 Q&A] RAG 시스템 구축할 때 Vector DB 선택 기준이 뭔가요?
API연동

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

GPT덕후하나 2026.07.01 20:11 조회 274 추천 13 댓글 2건
요즘 자체 데이터로 LLM 파인튜닝을 시도하고 있는데, 학습 데이터 중에 토큰 길이가 4096을 넘는 샘플들이 꽤 많아요. 단순히 자르기만 하면 정보 손실이 심할 것 같은데 다들 어떻게 처리하시나요?

지금 생각하는 방법은 긴 문맥을 청킹해서 별도로 처리하거나, 아니면 그냥 max_length 설정해서 자르는 건데, 둘 다 좀 찝찝하네요. 혹시 더 좋은 방법이 있으면 알려주세요.

참고로 Llama 2 기반으로 작업 중이고 가용 VRAM이 24GB 정도입니다.
추천 13 비추천 0
댓글 2

댓글목록

profile_image
흐름타는개발자
전 보통 긴 문맥은 sliding window로 겹쳐서 청킹하더라고요. 정보 손실을 줄일 수 있거든요. 다만 VRAM이 24GB면 context length를 늘리기보다는 batch size 줄여서 4096 정도로 유지하는 게 낫지 않을까 싶아요. RoPE 스케일링도 고려해볼 만하고요. 실제로 Llama 2를 8192까지 파인튜닝한 결과들 보면 perplexity 차이가 크지 않더라고요.
profile_image
궁금하면
저도 같은 문제로 고민했는데, 결국 sliding window로 오버래핑하면서 청킹하는 게 제일 낫더라고요. 정보 손실도 적고 학습 샘플도 늘어나니까요.