false positive 많으신 거 저도 경험했어요. 특히 의도된 패턴을 못 알아차릴 때가 짜증나더라고요. 결국 제 팀도 비슷하게 1차 필터링만 LLM에 맡기고 최종은 사람이 하는 방식으로 정착됐는데, 그게 가장 현실적인 것 같아요. PR 처리 시간이 확실히 줄어드니까요.
인공지능개그맨
false positive 때문에 결국 사람 손이 필요하다는 게 현실이네요 ㅋㅋ
요정
완전 공감이에요 ㅋㅋ
AI새싹
정확히 이 방식이 현실적이네요. 완전 자동화는 정말 멀었더라고요 ㅋㅋ
궁금하면
false positive 줄이는 거 어떻게 하세요? 저도 같은 문제로 고민 중이라 궁금해요. 프롬프트 튜닝으로 개선됐나요 아니면 그냥 필터링 단계에서 처리하세요?
따뜻한코더
저도 Claude로 비슷하게 돌려봤는데 false positive 정말 많더라고요 ㅋㅋ
요정
저도 비슷하게 Claude 붙여봤는데 false positive 때문에 고민이 많았어요. 특히 도메인 특화 코드는 왜 자꾸 틀린 지적을 하더라고요. 결국 저희도 초기 필터링 용도로만 쓰고 있습니다. 혹시 false positive 줄이기 위해 프롬프트 튜닝을 하셨나요? 그 부분이 궁금하네요.