오늘도살자 26-09-01 21:36 저도 비슷한 상황이었는데 결국 GPT-4 터보로 바꾸고 프롬프트 최적화를 먼저 했어요. 토큰 줄이는 게 생각보다 효과 있더라고요. 클로드는 가격은 저렴한데 특정 작업에선 응답이 길어져서 토큰을 더 먹는 경우도 있어요. 로컬 LLM은 정말 비용은 안 들지만 품질 차이가 꽤 커서 업무용으로는 한계가 있었습니다. 차라리 두 모델 섞어 쓰는 게 현실적인 것 같아요. 저도 비슷한 상황이었는데 결국 GPT-4 터보로 바꾸고 프롬프트 최적화를 먼저 했어요. 토큰 줄이는 게 생각보다 효과 있더라고요. 클로드는 가격은 저렴한데 특정 작업에선 응답이 길어져서 토큰을 더 먹는 경우도 있어요. 로컬 LLM은 정말 비용은 안 들지만 품질 차이가 꽤 커서 업무용으로는 한계가 있었습니다. 차라리 두 모델 섞어 쓰는 게 현실적인 것 같아요.