2026.07.15 접속자 56명

로그인 | 회원가입 | AI 서비스

HOT

[AI뉴스] 요즘 AI 기업들 뭐 하는지 봤어요? 삼성부터 구글까지 정신없네 [자유게시판] 요즘 편의점 계절 신상 많던데 뭐가 괜찮더라고요 [자유게시판] 편의점 야식을 계속 사먹다니 이게 뭐 하는 짓이냐 [자유게시판] 편의점 야시간 알바 2주 후기 [프롬프트] 마케팅 복사문 작성할 때 쓰는 프롬프트 공유해요 [프롬프트] Claude한테 좋은 결과 뽑아낼 프롬프트 팁 있으신가요? [자유게시판] 직장 다니면서 운동 어떻게 하세요? [자유게시판] 편의점 알바 3개월 해본 솔직한 후기 [프롬프트] 코드 생성할 때 프롬프트 구조 어떻게 짜세요? [AI뉴스] GPT-5.6 드디어 풀렸네요, 그리고 요즘 AI 흐름 정리해봤어요 [AI뉴스] 요즘 AI 기업들 뭐 하는지 봤어요? 삼성부터 구글까지 정신없네 [자유게시판] 요즘 편의점 계절 신상 많던데 뭐가 괜찮더라고요 [자유게시판] 편의점 야식을 계속 사먹다니 이게 뭐 하는 짓이냐 [자유게시판] 편의점 야시간 알바 2주 후기 [프롬프트] 마케팅 복사문 작성할 때 쓰는 프롬프트 공유해요 [프롬프트] Claude한테 좋은 결과 뽑아낼 프롬프트 팁 있으신가요? [자유게시판] 직장 다니면서 운동 어떻게 하세요? [자유게시판] 편의점 알바 3개월 해본 솔직한 후기 [프롬프트] 코드 생성할 때 프롬프트 구조 어떻게 짜세요? [AI뉴스] GPT-5.6 드디어 풀렸네요, 그리고 요즘 AI 흐름 정리해봤어요

목록

API연동

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

GPT덕후하나 2026.05.16 18:33 조회 153 추천 14 댓글 3건

요즘 자사 데이터로 오픈소스 모델을 파인튜닝하려고 하는데 문제가 생겼어요. 학습 데이터 중에 컨텍스트 길이를 초과하는 샘플들이 꽤 많거든요. 단순히 잘라내면 정보 손실이 생길 것 같고, 그렇다고 모델의 컨텍스트 윈도우를 늘리려니까 리소스가 너무 많이 들어요.

혹시 이런 경우에 일반적으로 어떻게 처리하세요? 청킹해서 여러 개의 샘플로 나누는 게 정답인지, 아니면 더 좋은 방법이 있는지 궁금합니다. 특히 시퀀스 연속성이 중요한 작업이라서 단순한 청킹이 효과적일지 의문이 네요.

경험 공유해주시면 감사하겠습니다.

추천 14 비추천 0

이전글LLM 비교해본 결과 - 코딩할 땐 Claude가 확실히 낫더라고요26.05.17
다음글LLM 토큰 계산할 때 실제로 뭘 기준으로 하세요?26.05.15

댓글 3

댓글목록

인공지능개그맨

26-05-21 18:46

저도 비슷한 상황을 겪었는데 결국 sliding window로 겹치게 청킹하는 게 제일 나았어요. 단순 절단보다는 연속성이 훨씬 잘 유지되더라고요. 다만 오버래핑 비율을 어느 정도로 할지가 관건인데 보통 50% 정도에서 괜찮은 결과가 나왔습니다. 아니면 긴 시퀀스는 아예 다른 태스크로 따로 학습시키는 방법도 있더군요.

흐름타는개발자

26-06-19 05:50

저도 비슷한 문제 겪었는데 결국 sliding window로 오버래핑하면서 청킹했어요. 100% 정보 손실은 막을 수 없지만 중요한 부분은 여러 샘플에 걸쳐서 포함되게 하니까 어느 정도는 괜찮더라고요. 시퀀스 연속성이 중요하면 특히 이 방법이 도움될 것 같습니다.

조용한엔지니어

26-07-14 16:11

오 저도 같은 문제로 삽질했어요 ㅠㅠ