우리도 이 문제로 고생하고 있습니다. 생성형 AI 콘텐츠 감지가 점점 더 어려워지고 있는데, 특히 Humanizer와 같은 도구를 활용해 전형적인 AI 징후를 피하는 경우라면 더 그렇습니다.
커뮤니티 관리자의 관점에서 보면, 포럼에 챗봇을 허용하는 것은 커뮤니티의 생명력을 갉아먹는 일이라고 생각합니다. 사람들이 AI와 대화하고 싶었다면 이미 그렇게 했을 것입니다. 그들은 사람과 대화하고 싶어서 여기에 온 것입니다.
아직 해결책을 찾지 못했습니다. AI 탐지 도구를 몇 번 테스트해 보았지만, 이는 고양이와 쥐의 게임과 같고 오탐이 너무 많습니다. 당분간은 포럼 정책을 시행하고 있으며(곧 더 강하게 알릴 예정입니다), 커뮤니티 모더레이터들의 도움을 받아 문제를 발견하고 확인하며 정리하는 방식으로 대응하고 있습니다.
솔직히 말하면 지치기 일쑤고, 봇에 의해 커뮤니티가 잠식당한다면 그 미래가 걱정될 때도 있습니다.
이것은 1990년대 후반과 2000년대 초반 이메일 상황과 매우 닮아 있습니다. 당시 저는 작은 디자인 회사의 시스템 관리자였는데, 직원들이 업무 과정에서 이메일을 사용하기 시작했고, 스팸 메일이 너무 많이 쏟아져 나와 이메일이 거의 쓸모없어질 정도였습니다. 그 시절에는 스팸을 잡는 것이 지렁이 잡기(whack-a-mole)와 같았습니다.
결국 그 문제는 어떻게 통제될 수 있었을까요? AI 사용도 결국 비슷한 과정을 거칠까요? 수십 년이 걸릴까요?
현재로서는 이것이 유일한 관리 방법인 것 같습니다. AI 생성물을 어느 정도 신뢰성 있게 감지할 수 있는 변수가 너무 많고, 그 반대 주장을 하는 사람은 사기꾼일 뿐입니다. 대충 만든 AI 생성물은 잡기 쉽지만, 그 외의 경우엔 어떻게 작성되었는지를 추측하려 하지 않고 각 게시물의 내용 자체의 가치를 기준으로 판단해야 합니다.
AI 사용은 오래전부터 우리 가이드라인에 명시되어 있었으며, 문제는 주로 신규 사용자들 중 AI를 활용해 단순히 다른 사용자에게 답글을 남기는 것을 넘어, 소통보다는 논문과 유사한 과도하게 구조화되고 격식 있는 주제를 생성하는 사례가 증가하고 있다는 점이었습니다. 이는 사이트의 톤과 참여도에 부정적인 영향을 미쳤습니다. 소규모 팀에게는 이러한 콘텐츠를 조정하는 데 상당한 시간이 소요되었고, 일부 사용자는 조정 조치에 강하게 반발하여 불쾌하고 논쟁적인 상황이 발생하기도 했습니다. 이에 저는 디스코urs에 AI 에이전트(GPT 5.5 기반)를 구축하고, 핵심 카테고리에서 신규 멤버가 생성한 주제를 스캔하는 자동화 기능을 도입했습니다. 이 시스템은 AI 생성 징후를 평가하여 자동 플래그를 트리거하고, 플래그가 부여된 이유에 대한 정중한 설명, 가이드라인 참조 및 더 나은 참여를 위한 조언을 제공합니다. 관리자는 잘못된 플래그나 경계선 사례에 대해 해제할 수 있습니다. 이 시스템은 매우 높은 정확도를 보이며, 훨씬 적은 시간으로 올바른 행동을 유도하고 갈등을 피하는 데 성공했습니다.
우리는 주요 테크 기업으로부터의 레이트 리미팅(요청 제한)이 적용된 스크래핑은 허용하지만, 사용량 한도를 초과하게 만든 방대한 수의 연결을 유발한 나머지 기업들은 블랙리스트에 등록했습니다. 사이트 내 대부분의 악성 행위자와 마찬가지로, 소수의 사용자가 시간과 자원을 불균형하게 많이 소비하는 경향이 있습니다.
나는 사람들이 인간임을 입증하기 위해 일부러 em dash(—) 사용을 의식적으로 피해야 한다고 생각한다
최근 LinkedIn에서 em dash를 사용했다는 이유로 짧은 게시글에 도전장을 던지는 답글을 남겼습니다. 물론 답장은 오지 않았는데, 그 게시글이 인간인 척하는 봇이 작성한 것이었기 때문입니다. … 그리고 분명히 그 봇은 불이익이나 놀림에 대처하도록 프로그래밍되어 있지 않았던 것 같더군요
우리는 예술에 특화된 디스코르드(Discourse) 서버에서 AI 사용을 금지하고 있으며, 지금까지 꽤 긍정적인 반응을 얻고 있습니다. 예술 커뮤니티라면 이런 반응이 나올 것이라고 어느 정도 예상했습니다. 이미지에 대해서는 처음부터 엄격한 금지를 적용했으며, 이후 텍스트와 코드(단순 번역의 경우, 언어를 못 해서만 벌을 받지 않도록 예외를 두었습니다)를 포함한 모든 생성 콘텐츠로 규칙을 확장했습니다. 코드가 금지 대상(예: 그림 프로그램용 플러그인)으로 지정되었을 때 일부 사람들 사이에서 작은 논쟁이 있었지만, 대부분은 조용히 받아들였습니다. AI가 예술 커뮤니티 전체에 끼친 피해를 고려할 때, AI를 금지하고 이에 반대하는 입장을 취하는 것은 우리 커뮤니티에서도 어느 정도 예상되는 일이었습니다. 가끔 플러그인 제작자들이 불만을 제기하지만, 우리는 원하는 것은 무엇이든 해도 좋지만 우리 포럼에 게시하지 말라고 안내하며, 대부분은 이 조건을 받아들이고 있습니다. 때로는 "이것을 허용하지 않으면 소프트웨어가 뒤처질 것이다"라고 협박하거나, FOMO(소외 불안)를 유발하거나, 죄책감을 느끼게 하여 규칙을 철회하라고 압박하는 경우도 있지만, 대체로 조용한 편입니다.
모더레이션(운영) 측면에서는 주로 커뮤니티에 의존하고 있습니다. AI 콘텐츠 보고를 위한 별도의 플래그를 두고 있습니다. 확인 과정에서 불신과 의심의 커뮤니티를 만들고 싶지 않으므로, 일단 모든 사람을 무죄로 간주합니다. 어떤 것이 AI로 생성된 것인지 확실히 증명할 수 없다면, 해당 콘텐츠는 그대로 두는 것이 일반적입니다. 작품이 AI처럼 보인다는 이유만으로 실제로는 그렇지 않은 완전히 무고한 사용자를 실수로 금지하는 것을 원하지 않으며, 마녀 사냥 같은 분위기가 조성되어서는 안 됩니다.
다행히도 AI 사용자는 종종 생성기 워터마크를 제거하는 것을 잊거나, 파일명에 "gemini generated image"와 같은 문구가 남아 있거나, 스타일이나 품질이 극적으로 달라지는 등의 실수를 통해 스스로를 드러내는 경우가 많습니다.