2026.09.22 접속자 54
로그인 회원가입
HOT
[AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요 [자유게시판] 요즘 커피 중독인데 이게 정상인가요 [자유게시판] 요즘 직장인들 퇴근 후에 뭐 하면서 시간 보내세요? [프롬프트] 코드 리뷰 프롬프트 효과본 누계 있으세요? [AI뉴스] 최근 LLM 모델들 정리해봤는데 진짜 미친 속도로 늘어나네요 [AI뉴스] GPT-6 Astra 나왔다는데 동시에 ChatGPT 먹통? 이게 뭐하는 짓인지 모르겠네요 [AI뉴스] 2026년 AI 정말 달라지긴 다는데... 에이전트 시대가 오는 건가요? [AI뉴스] 요즘 딥러닝 논문들 보니까 '큰 모델' 시대는 끝난 것 같아요 [AI뉴스] 올해 AI 시장 핫이슈 정리해봤어요. 에이전트 AI, 추론형 LLM이 대세네요 [자유게시판] 요즘 편의점 가격이 진짜 미치는 것 같은데 [프롬프트] Claude에게 좋은 프롬프트 작성법 궁금해요 [자유게시판] 요즘 커피 중독인데 이게 정상인가요 [자유게시판] 요즘 직장인들 퇴근 후에 뭐 하면서 시간 보내세요? [프롬프트] 코드 리뷰 프롬프트 효과본 누계 있으세요? [AI뉴스] 최근 LLM 모델들 정리해봤는데 진짜 미친 속도로 늘어나네요 [AI뉴스] GPT-6 Astra 나왔다는데 동시에 ChatGPT 먹통? 이게 뭐하는 짓인지 모르겠네요
API연동

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

따뜻한코더 2026.09.18 13:30 조회 23 추천 1 댓글 0건
최근 자사 데이터로 오픈소스 모델을 파인튜닝하려고 하는데, 학습 데이터 중에 컨텍스트가 긴 문서들이 많거든요. 모델의 토큰 길이 제한(예를 들어 4K)을 넘는 데이터를 어떻게 전처리해야 할지 고민이네요.

지금까지 본 방법들은 슬라이딩 윈도우로 자르거나, 요약을 먼저 하는 방식들인데 각각 트레이드오프가 있더라고요. 슬라이딩 윈도우는 컨텍스트 손실이 있고, 요약은 원본 정보가 줄어들 수 있고요.

혹시 실무에서 이런 상황 겪으신 분 있으신가요? 어떻게 해결하셨는지 궁금합니다.
추천 1 비추천 0
댓글 0

댓글목록

아직 댓글이 없습니다. 첫 댓글을 남겨보세요!