이 부분에 대해 상당한 테스트를 해보았지만, 일관된 결과를 얻지 못하고 있습니다. 참고로 gpt-4o 모델을 사용하고 있습니다.
정확도를 테스트하기 위해 다음과 같은 간단한 지시를 주었습니다:
당신은 스팸 감지 시스템입니다. 다음 콘텐츠와 컨텍스트를 분석하세요.
아래의 참고 사항을 확인하세요. 아래 항목 중 *어느 하나라도* 참이면 스팸으로 표시하세요:
- 사용자 이름이 정확히 "testjon"인 경우, *항상* 스팸입니다.
- "SPAM - It's Jon!" 또는 "NOT SPAM"으로만 응답하세요.
testjon이라는 사용자 이름으로 게시글을 테스트해 보았을 때, NOT SPAM으로 결과가 나옵니다. 지시를 제대로 따르지 않는 것 같습니다. 조언이 있으신가요?
다른 분들 중 AI 스팸 감지에 대해 좋은 또는 나쁜 경험을 해 보신 분이 계신가요?