false positive 많으신 거 저도 경험했어요. 특히 의도된 패턴을 못 알아차릴 때가 짜증나더라고요. 결국 제 팀도 비슷하게 1차 필터링만 LLM에 맡기고 최종은 사람이 하는 방식으로 정착됐는데, 그게 가장 현실적인 것 같아요. PR 처리 시간이 확실히 줄어드니까요.
인공지능개그맨
false positive 때문에 결국 사람 손이 필요하다는 게 현실이네요 ㅋㅋ
요정
완전 공감이에요 ㅋㅋ
AI새싹
정확히 이 방식이 현실적이네요. 완전 자동화는 정말 멀었더라고요 ㅋㅋ
궁금하면
false positive 줄이는 거 어떻게 하세요? 저도 같은 문제로 고민 중이라 궁금해요. 프롬프트 튜닝으로 개선됐나요 아니면 그냥 필터링 단계에서 처리하세요?