2026.07.31 접속자 38
로그인 회원가입
HOT
[AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [AI뉴스] 이제 생성형 AI는 그냥 도구가 아니더라... 에이전틱 AI 시대가 온다는데 [프롬프트] AI한테 요구사항 정리해달라고 하는데 자꾸 틀린 정보를 줘요 [AI뉴스] 요즘 딥러닝 논문들 방향이 좀 달라졌더라고요 [AI뉴스] 올해 LLM 모델들 계속 쏟아지고 있네요 [프롬프트] AI한테 물어보는 방식 바꿔보니까 답의 질이 확 달라지더라고요 [AI뉴스] 요즘 LLM 모델들이 쏟아져 나오는데 뭘 써야 할지 모르겠어요 [프롬프트] 업무 지시사항을 프롬프트로 변환하니까 결과가 달라지네요 [프롬프트] 코드 리뷰 요청할 때 쓸 만한 프롬프트 있으신가요? [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [AI뉴스] 이제 생성형 AI는 그냥 도구가 아니더라... 에이전틱 AI 시대가 온다는데 [프롬프트] AI한테 요구사항 정리해달라고 하는데 자꾸 틀린 정보를 줘요 [AI뉴스] 요즘 딥러닝 논문들 방향이 좀 달라졌더라고요 [AI뉴스] 올해 LLM 모델들 계속 쏟아지고 있네요 [프롬프트] AI한테 물어보는 방식 바꿔보니까 답의 질이 확 달라지더라고요 [AI뉴스] 요즘 LLM 모델들이 쏟아져 나오는데 뭘 써야 할지 모르겠어요 [프롬프트] 업무 지시사항을 프롬프트로 변환하니까 결과가 달라지네요 [프롬프트] 코드 리뷰 요청할 때 쓸 만한 프롬프트 있으신가요?
API연동

LLM 파인튜닝할 때 토큰 길이 제한 문제 어떻게 해결하세요?

현실주의자 2026.06.01 18:15 조회 174 추천 14 댓글 2건
요즘 자사 데이터로 오픈소스 모델(라마2)을 파인튜닝 중인데, 학습 데이터 중 일부가 컨텍스트 윈도우(4k 토큰)를 초과하더라고요. 단순히 자르자니 정보 손실이 생길까봐 걱정이고, 그렇다고 더 큰 모델로 가자니 비용이 장난 아니네요.

혹시 이런 상황에서 효과적인 방법 써보신 분 계신가요? 슬라이딩 윈도우로 오버래핑하게 하거나, 요약을 거쳐서 넣는 방식도 고민 중인데 실제로 써본 결과가 어떨지 궁금합니다. 아니면 처음부터 데이터 전처리를 다르게 해야 하는 건지.
추천 14 비추천 0
댓글 2

댓글목록

profile_image
조용한엔지니어
저도 비슷한 문제 겪었는데 결국 청킹 방식을 섞어서 했어요. 긴 문서는 의미 있는 단락 단위로 나눠서 각각을 학습 샘플로 만들고, 문맥이 필요한 부분만 이전 청크와 오버래핑하게 했거든요. 단순 자르기보다는 효과가 훨씬 낫더라고요.
요약 방식은 솔직히 정보 손실 때문에 주의가 필요한데, 요약 자체가 LLM을 거쳐야 하니까 추가 비용도 들고요. 차라리 구조화된 청킹이 낫다고 봅니다.
profile_image
궁금하면
저도 비슷한 문제 겪었는데 결국 슬라이딩 윈도우로 오버래핑하는 게 가장 실용적이더라고요. 처음엔 정보 손실 걱정했는데 생각보다 괜찮았습니다. 요약은 오히려 의도와 다르게 변형될 수 있어서 피했어요. 혹시 긴 문서면 문단 단위로 끊어서 라벨링하는 방식도 고민해볼 만합니다.