# Discourse AI - 독성

**URL:** https://meta.discourse.org/t/discourse-ai-toxicity/259215
**Category:** Site Management
**Tags:** ai, ai-toxicity
**Created:** [4월 24, 2023, 7:39오후 UTC](https://meta.discourse.org/t/discourse-ai-toxicity/259215 "2023-04-24T19:39:50Z")
**Posts on this page:** 1
**Showing post:** 1

<div class="post-metadata">

### Author: ![Discourse](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/discourse/32/148734_2.png) [@Discourse](https://meta.discourse.org/u/Discourse)
#### Post date: [4월 24, 2023, 7:39오후 UTC](https://meta.discourse.org/t/discourse-ai-toxicity/259215/1 "2023-04-24T19:39:50Z")

</div>

> 🔖 이 주제는 [Discourse AI](https://meta.discourse.org/t/discourse-ai/259214?slient=true) 플러그인의 Toxicity(독성) 기능 설정에 대해 다룹니다.
> 
> 🙋 필요한 사용자 권한: 관리자

Toxicity 모듈은 Discourse 인스턴스의 모든 새 포스트와 채팅 메시지의 독성 점수를 자동으로 분류합니다. 임계값을 초과하는 콘텐츠가 자동으로 플래깅되도록 설정할 수도 있습니다.

분류 결과는 데이터베이스에 저장되므로, 플러그인을 활성화한 후 [Data Explorer](https://meta.discourse.org/t/32566?silent=true)를 사용하여 Discourse의 새 콘텐츠에 대한 분류 보고서를 즉시 사용할 수 있습니다. 이를 더 쉽게 하기 위해 곧 플러그인과 함께 기본 [Data Explorer](https://meta.discourse.org/t/32566?silent=true) 쿼리를 제공할 예정입니다.

### 설정

- **ai\_toxicity\_enabled** : 모듈을 활성화하거나 비활성화합니다

- **ai\_toxicity\_inference\_service\_api\_endpoint** : 독성 모듈용 API가 실행되는 URL입니다. CDCK 호스팅을 사용하는 경우 자동으로 처리됩니다. 자체 호스팅(self-hosting)을 사용하는 경우 [자체 호스팅 가이드](https://meta.discourse.org/t/discourse-ai-self-hosted-guide/259598)를 확인하세요.

- **ai\_toxicity\_inference\_service\_api\_key** : 위에서 설정한 독성 API의 API 키입니다. CDCK 호스팅을 사용하는 경우 자동으로 처리됩니다. 자체 호스팅을 사용하는 경우 [자체 호스팅 가이드](https://meta.discourse.org/t/discourse-ai-self-hosted-guide/259598)를 확인하세요.

- **ai\_toxicity\_inference\_service\_api\_model** : ai\_toxicity\_inference\_service\_api\_model: `original`, `unbiased`, `multilingual`의 세 가지 모델이 제공됩니다. 학습 자료에서 도입된 편향이 분류에 반영되지 않도록 하므로 `original`보다 `unbiased`를 권장합니다. 다국어 커뮤니티의 경우, 마지막 모델은 이탈리아어, 프랑스어, 러시아어, 포르투갈어, 스페인어, 터키어를 지원합니다.

- **ai\_toxicity\_flag\_automatically** : 특정 카테고리의 분류가 설정된 임계값을 초과할 때 포스트/채팅 메시지를 자동으로 플래깅합니다. 사용 가능한 카테고리는 `toxicity`, `severe_toxicity`, `obscene`, `identity_attack`, `insult`, `threat`, `sexual_explicit`입니다. 각각에 대해 `ai_toxicity_flag_threshold_${category}` 설정이 있습니다.

- **ai\_toxicity\_groups\_bypass** : 해당 그룹에 속한 사용자의 포스트는 독성 모듈에 의해 분류되지 않습니다. 기본적으로 스태프 사용자를 포함합니다.

## 추가 자료

- [Discourse AI](https://meta.discourse.org/t/discourse-ai/259214?silent=true)
- [Install plugins on a self-hosted site](https://meta.discourse.org/t/install-plugins-in-discourse/19157?silent=true)

---

_[View the full topic](https://meta.discourse.org/t/discourse-ai-toxicity/259215)._
