2026.09.21 접속자 49
로그인 회원가입
HOT
[AI뉴스] 요즘 오픈소스 AI 모델 뭐 쓰고 계시나요? [AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [프롬프트] 프롬프트에 "역할 지정"을 꼭 넣어야 하나요? [자유게시판] 요즘 날씨 때문에 피부 난리네요 [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [자유게시판] 요즘 혼자 밥 먹을 때 뭐하면서 먹으세요? [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [자유게시판] 요즘 직장인들 점심 뭐 먹으세요? [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요 [AI뉴스] 요즘 오픈소스 AI 모델 뭐 쓰고 계시나요? [AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [프롬프트] 프롬프트에 "역할 지정"을 꼭 넣어야 하나요? [자유게시판] 요즘 날씨 때문에 피부 난리네요 [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [자유게시판] 요즘 혼자 밥 먹을 때 뭐하면서 먹으세요? [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [자유게시판] 요즘 직장인들 점심 뭐 먹으세요? [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요
프롬프트

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

요정 2026.07.10 15:09 조회 242 추천 13 댓글 1건
요즘 자사 데이터로 모델을 파인튜닝하려고 하는데 문제가 생겼네요. 학습 데이터 중에 컨텍스트가 긴 문서들이 꽤 많거든요. 보통 4K 토큰 제한이 있는 모델 기준으로 초과하는 부분을 어떻게 처리하는지 궁금합니다.

지금까진 단순히 잘라내거나 요약하는 방식을 생각했는데 정보 손실이 많을 것 같아서요. 슬라이딩 윈도우 방식으로 여러 개 샘플로 나누는 게 나을까요? 아니면 애초에 더 큰 컨텍스트 윈도우 모델을 쓰는 게 낫나 싶기도 하고요.

실제로 장문 데이터로 파인튜닝해본 분들은 어떤 방식을 쓰셨는지 궁금합니다. 특히 성능 차이가 있었는지 궁금하네요.
추천 13 비추천 0
댓글 1

댓글목록

profile_image
딥러닝장인
저도 비슷한 문제 겪었는데 결국 슬라이딩 윈도우 방식이 제일 나더라고요. 단순히 자르는 것보다 정보 손실이 적고 샘플 수도 늘어나니까 학습도 잘 되는 것 같았어요. 다만 오버래핑 비율을 적절히 설정해야 하는데 보통 20~30% 정도로 했을 때가 제일 무난했습니다. 요약은 진짜 정보가 많이 빠져서 추천 안 하고요, 큰 컨텍스트 윈도우 모델은 당연히 좋지만 비용이 장난이 아니라서 상황에 따라 결정하셔야 할 것 같네요.