AI 스팸 방지와 AI 게시물 분류가 함께 작동할 때의 모범 사례는?

초기에는 우려가 있었지만, Discourse AI 스팸 감지 기능을 도입한 후 놀라운 성과를 거두고 있습니다. 자가 호스팅한 Discourse 인스턴스가 스팸 없이 깨끗하게 유지되는 데 매우 효과적이었습니다.

제가 관리하는 Discourse 인스턴스기상 예보 사이트와 연결되어 있어 기후 변화, 현재 행정부의 NOAA 및 NASA 관련 정책 등 정치화된 주제에 대한 토론이 간혹 이루어집니다. 항상 대기할 수 있는 매우 작은 모더레이션 팀을 갖추고 있기 때문에, 모든 신규 및 수정된 게시글에서 ‘문화 전쟁’ 관련 항목을 확인하고 주의를 요하는 플래그를 설정하는 ‘포스트 트리아지(분류)’ 페르소나와 프롬프트를 사용하는 자동화를 구성했습니다. (트리아지 자동화는 숨김 처리가 아닌 플래그 설정만 수행하도록 설정했는데, 이는 논쟁적인 주제에 대해 더 빠르게 인간의 눈이 닿게 하여 대화가 문명적으로 유지되도록 하려는 것입니다.)

현재까지는 모든 것이 잘 작동하고 있습니다. 그러나 때때로 안티스팸 AI와 트리아지 AI가 동일한 게시글에 플래그를 설정하는 경우가 발생합니다. 이를 우회하기 위해 트리아지 프롬프트를 조금 조정해 보았지만, 프롬프트를 너무 많이 수정하면 트리아지의 효과성이 떨어질까 봐 우려됩니다.

안티스팸과 포럼 트리아지 자동화 모두에 의해 게시글이 이중으로 플래그되는 문제에 대해 다른 분들도 겪고 계신가요? 이 문제에 대한 올바른 해결책은 무엇일까요? 안티스팸과 함께 트리아지 자동화를 사용하지 말아야 하는 건가요, 아니면 이미 플래그가 설정된 게시글에 자동화가 플래그를 설정하지 않도록 하는 설정을 놓친 건가요?

다시 강조하고 싶은 것은 모든 것이 훌륭하게 작동하고 있으며, 두 시스템 모두 매우 효과적이라는 점입니다. 단지 두 가지 서로 다른 AI 작업이 서로의 영역에 개입하지 않도록 하고, 게시글이 두 번 플래그되는 것을 피할 수 있는 방법이 있는지 확인하고 싶을 뿐입니다. 조언을 부탁드립니다!

이중 플래그 지정이 문제를 일으키고 있다면, 해당 모듈 중 하나 또는 둘 다에 버그가 있는 것으로 보입니다. 이미 플래그가 지정된 게시물은 평가하지 않는 것이 적절할 것 같고, 플래그를 설정하기 전에 한 번 더 확인하는 로직을 추가하는 것도 고려해 볼 만합니다.

음, 분명히 “순서” 관련 문제인 것 같습니다. 스팸과 트리아지를 모두 처리하는 단일 페르소나로 전환해 보는 건 어떨까요? 아니면 tl0-1에는 스팸+트리아지를 담당하는 트리아지를, tl2에는 트리아지만 수행하는 별도의 트리아지를 설정하는 것도 방법일 것 같습니다.

좋은 지적이네요—다만 이 경우 내장된 안티스팸 기능을 비활성화하고 자동화에 의존하게 될 것 같습니다. 제가 뭔가 놓치고 있는 건 아닌지 모르겠네요 (매우 가능하죠!).

한 번 더 생각해 볼게요. 실제로는 그게 최선의 방법이 될 수도 있겠네요.