감시 단어: Discourse가 지원되지 않는 HTML 태그를 자동으로 제거합니까?

최근 저희 인스턴스에 몇 가지 감시 단어(watchword)를 추가했습니다.

하지만 사용자가 아래와 같은 방법으로 이를 우회하는 방법을 알아냈습니다. Discourse가 지원되지 않는 HTML 태그를 자동으로 제거하는지, 아니면 그대로 두는지 궁금합니다. 실제로 이 태그들은 게시글 안에 직접 삽입되어 있었으며, 검토 시스템이 발동되지 않았습니다.

dis</n>cord discord 
tampe</big>rmonkey

저희의 감시 단어 목록:

*discord*
*tampermonkey*

감시 대상 단어는 꽤나 구식입니다. 이를 우회하는 방법은 많습니다.

사용자가 그렇게 했다면 의도적으로 한 것이므로, 그에 상응하는 처벌을 내릴 수 있습니다.

불행히도 Discourse AI - 스팸 감지를 직접 확인해 보셔야 할 것 같습니다.

@jimmy0017 필요한 답을 찾으셨나요? Jay의 답변은 정확합니다. 차단된 단어는 규칙을 무시하려는 의지가 있는 사람들은 쉽게 우회할 수 있습니다. 커뮤니티의 일원이 되려면 규칙을 알아야 하고 이를 지켜야 한다는 점을 명확히 하기 위해 모더레이션(규율 관리)을 사용해야 합니다.

네… 하지만 그러면 문제인 게, ‘봇’ 등록도 더 많이 들어오게 돼요. 이런 걸 감시하는 모더레이터가 몇 명은 있어요. 하지만 무엇보다도, 유저들이 그런 콘텐츠를 애초에 보지 않는 게 제일 중요하거든요. 감시 단어를 의도적으로 우회한 몇몇 유저들을 영구 차단하기도 했어요.

AI 스팸 감지를 검토해 보고, 우리가 할 만한 일인지 생각해 볼 거예요. AI LLM을 쓰는 것보다 ‘감시 단어’를 처리하는 더 직접적인 방법이니까요.

그것이 사실이라면 이 글을 쓰지 않았을 것입니다. “단어 감시” 기능보다 더 똑똑한 봇들이 있습니다. 또한, 실제로는 인간들이라고 보는 것이 훨씬 가능성이 높습니다(지난 1년간 봇 기술이 크게 발전하여, 새 계정을 만들던 인간들이 직장을 잃었을 수도 있지만요).

또 다른 방법으로는 TL0/1 사용자의 모든 게시물을 승인하는 것입니다. 즉시 게시물이 표시되지 않아 슬퍼할 새로운 합법적 사용자가 많이 없다면, 그것도 “직접적인” 해결책이 될 수 있습니다.