2026.08.16 접속자 64
로그인 회원가입
HOT
[프롬프트] 요즘 Claude 프롬프트로 코드 리뷰 받으면서 배운 거 공유합니다 [AI뉴스] AI 규제 본격화되네요, 7월부터 AI기본법 시행된다고 하는데 [프롬프트] 프롬프트 작성할 때 '맥락'을 먼저 주는 게 진짜 차이 나더라고요 [프롬프트] 분석 보고서 작성할 때 쓰는 프롬프트 공유합니다 [AI뉴스] 2026년 후반기 AI 규제 대폭 강화되는데, 기업들은 준비됐나요? [프롬프트] 데이터 분석 프롬프트 효율적으로 짜는 법 뭐가 있을까요? [자유게시판] 요즘 출근길 지옥인데 혼자인가요 [AI뉴스] 이제 ChatGPT, Claude, Gemini 중 뭐를 써야 하는 거야? [AI뉴스] 올해 AI 트렌드 이제 생성형에서 에이전트 AI로 넘어가는 중이더라고요 [AI뉴스] 한국 기업들, AI 도입했는데 실제론 쓰는 곳 별로 없네요 [프롬프트] 요즘 Claude 프롬프트로 코드 리뷰 받으면서 배운 거 공유합니다 [AI뉴스] AI 규제 본격화되네요, 7월부터 AI기본법 시행된다고 하는데 [프롬프트] 프롬프트 작성할 때 '맥락'을 먼저 주는 게 진짜 차이 나더라고요 [프롬프트] 분석 보고서 작성할 때 쓰는 프롬프트 공유합니다 [AI뉴스] 2026년 후반기 AI 규제 대폭 강화되는데, 기업들은 준비됐나요? [프롬프트] 데이터 분석 프롬프트 효율적으로 짜는 법 뭐가 있을까요? [자유게시판] 요즘 출근길 지옥인데 혼자인가요 [AI뉴스] 이제 ChatGPT, Claude, Gemini 중 뭐를 써야 하는 거야? [AI뉴스] 올해 AI 트렌드 이제 생성형에서 에이전트 AI로 넘어가는 중이더라고요 [AI뉴스] 한국 기업들, AI 도입했는데 실제론 쓰는 곳 별로 없네요
API연동

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

GPT덕후하나 2026.07.01 20:11 조회 250 추천 12 댓글 1건
요즘 자체 데이터로 LLM 파인튜닝을 시도하고 있는데, 학습 데이터 중에 토큰 길이가 4096을 넘는 샘플들이 꽤 많아요. 단순히 자르기만 하면 정보 손실이 심할 것 같은데 다들 어떻게 처리하시나요?

지금 생각하는 방법은 긴 문맥을 청킹해서 별도로 처리하거나, 아니면 그냥 max_length 설정해서 자르는 건데, 둘 다 좀 찝찝하네요. 혹시 더 좋은 방법이 있으면 알려주세요.

참고로 Llama 2 기반으로 작업 중이고 가용 VRAM이 24GB 정도입니다.
추천 12 비추천 0
댓글 1

댓글목록

profile_image
흐름타는개발자
전 보통 긴 문맥은 sliding window로 겹쳐서 청킹하더라고요. 정보 손실을 줄일 수 있거든요. 다만 VRAM이 24GB면 context length를 늘리기보다는 batch size 줄여서 4096 정도로 유지하는 게 낫지 않을까 싶아요. RoPE 스케일링도 고려해볼 만하고요. 실제로 Llama 2를 8192까지 파인튜닝한 결과들 보면 perplexity 차이가 크지 않더라고요.