2026.08.24 접속자 73
로그인 회원가입
HOT
[프롬프트] LLM한테 코드 리뷰 요청하는데 이 프롬프트 써보세요 [자유게시판] 직장 다니면서 취미생활 뭐 하시는데요? [프롬프트] ChatGPT한테 물어봐도 자꾸 같은 답만 나와요, 프롬프트 어떻게 짜야 하나요? [자유게시판] 요즘 점심 뭐 먹으세요? [AI뉴스] 2026년 상반기 LLM 출시 정리... 오픈소스 진짜 대세가 되네요 [AI뉴스] 한국, EU보다 먼저 AI 규제 본격화... 7월 21일부터 뭐가 바뀌나요 [AI뉴스] 요즘 딥러닝 연구 방향 완전 바뀌는 중이네요 [자유게시판] 요즘 치약 뭐 쓰세요? 추천해주세요 [AI뉴스] 요즘 AI 투자 버블이 진짜 심하네요... [AI뉴스] 이제 생성형 AI가 아니라 에이전트 AI 시대네요 [프롬프트] LLM한테 코드 리뷰 요청하는데 이 프롬프트 써보세요 [자유게시판] 직장 다니면서 취미생활 뭐 하시는데요? [프롬프트] ChatGPT한테 물어봐도 자꾸 같은 답만 나와요, 프롬프트 어떻게 짜야 하나요? [자유게시판] 요즘 점심 뭐 먹으세요? [AI뉴스] 2026년 상반기 LLM 출시 정리... 오픈소스 진짜 대세가 되네요 [AI뉴스] 한국, EU보다 먼저 AI 규제 본격화... 7월 21일부터 뭐가 바뀌나요 [AI뉴스] 요즘 딥러닝 연구 방향 완전 바뀌는 중이네요 [자유게시판] 요즘 치약 뭐 쓰세요? 추천해주세요 [AI뉴스] 요즘 AI 투자 버블이 진짜 심하네요... [AI뉴스] 이제 생성형 AI가 아니라 에이전트 AI 시대네요
프롬프트

LLM 파인튜닝할 때 토큰 길이 제한 어떻게 처리하세요?

요정 2026.07.10 15:09 조회 122 추천 11 댓글 0건
요즘 자사 데이터로 모델을 파인튜닝하려고 하는데 문제가 생겼네요. 학습 데이터 중에 컨텍스트가 긴 문서들이 꽤 많거든요. 보통 4K 토큰 제한이 있는 모델 기준으로 초과하는 부분을 어떻게 처리하는지 궁금합니다.

지금까진 단순히 잘라내거나 요약하는 방식을 생각했는데 정보 손실이 많을 것 같아서요. 슬라이딩 윈도우 방식으로 여러 개 샘플로 나누는 게 나을까요? 아니면 애초에 더 큰 컨텍스트 윈도우 모델을 쓰는 게 낫나 싶기도 하고요.

실제로 장문 데이터로 파인튜닝해본 분들은 어떤 방식을 쓰셨는지 궁금합니다. 특히 성능 차이가 있었는지 궁금하네요.
추천 11 비추천 0
댓글 0

댓글목록

아직 댓글이 없습니다. 첫 댓글을 남겨보세요!