요즘 AI 스팸이 많이 들어와서 하나하나 확인하는 데 시간이 많이 걸립니다.
지금 보고 있는 스팸은 영어가 완벽하고, VPN을 사용 중이며, 이메일 주소는 StopForumSpam에 등록되어 있습니다. 또한 키보드에 없는 대시 문자가 사용된 것으로 보아 내용이 복사/붙여넣기된 것이 분명합니다. 하지만 이 모든 것을 수동으로 확인해야 했으며, 오늘 아침에도 아직 확인해야 할 스팸이 몇 개 더 남아 있습니다.
또 다른 아이디어를 생각해 보았습니다:
게시글이 저장될 때, Discourse가 해당 게시글의 JSONB 필드에 추가 데이터를 기록할 수 있습니다:
- IP 주소
- is_vpn? — MaxMind를 조회하여 조직을 확인하고 VPN인지 확인 (예: PacketHub S.A.)
- StopForumSpam에서 이메일 주소에 대한 빠른 조회
- 에디터에 출력된 문자 수와 실제로 입력된 출력 생성 문자 수 비교 (화살표 키, Ctrl 등 제외). 예를 들어, 사용자가 원본 콘텐츠에 1,000자를 출력했지만 실제로 출력 생성 키를 10번만 눌렀다면(이는 내용이 붙여넣기된 후 사용자가 한 단어 정도를 수정했을 가능성을 시사합니다).
- 키보드 단축키나 마우스 오른쪽 버튼을 사용하여 내용을 복사하거나 잘라낸 횟수.
- 키보드 단축키나 마우스 오른쪽 버튼을 사용하여 내용을 붙여넣은 횟수. 복사/붙여넣기 횟수의 차이는 또 다른 단서가 될 수 있습니다.
관리자는 작은 테이블 형태로 게시글의 이러한 데이터를 확인할 수 있습니다. 비정상적인 값은 강조 표시되어 의심스러운 게시글이 눈에 띄도록 할 수 있습니다.
완벽한 자동화 탐지 방법은 없을 수 있지만, 더 많은 정보를 제공하면 모더레이션 프로세스가 빨라질 것입니다.