이 가이드는 Discourse AI의 포럼 리서처(Forum Researcher) 에이전트, 그 작동 방식, 그리고 포럼 콘텐츠 심층 분석을 위한 설정 방법을 설명합니다.
필요한 사용자 권한: 관리자 (활성화 및 설정을 위해), 모든 사용자 (액세스가 부여된 경우 상호작용을 위해)
포럼 리서처 에이전트 이해 및 사용
Discourse AI 플러그인에는 포럼 리서처(Forum Researcher) 에이전트가 포함되어 있습니다. 이는 포럼 내 콘텐츠에 대한 심층적인 연구를 수행하도록 설계된 강력한 도구입니다. 이 에이전트는 인사이트를 발굴하고, 토론을 요약하며, 커뮤니티 전반의 트렌드를 분석하는 데 도움이 될 수 있습니다.
요약
이 문서에서는 다음 내용을 다룹니다:
- 포럼 리서처 에이전트의 작동 방식.
- 포럼 리서처 설정 단계.
- 에이전트와의 상호작용에 대한 모범 사례.
- 포럼 리서처와 표준 포럼 헬퍼 도구 간의 차이점.
- 적절한 대규모 언어 모델(LLM) 선택에 대한 안내.
- 연구 작업에 대한 디버깅 팁.
- 에이전트의 현재 한계.
작동 방식
포럼 리서처 에이전트는 전용 리서처(Researcher) 도구를 사용합니다. 이 도구는 다음과 같은 목적으로 설계되었습니다:
- 포럼 콘텐츠 접근: 포럼의 다양한 섹션을 읽을 수 있습니다.
- 고급 필터 적용: 유연한 필터 시스템을 통해 관련 정보를 정확하게 대상화할 수 있습니다. 다음 기준으로 콘텐츠를 지정할 수 있습니다:
- 특정 카테고리 (예:
category:support또는categories:support,feedback) - 태그 (예:
tag:bug또는tags:bug,regression) - 사용자 또는 그룹 (예:
username:sam,usernames:sam,jane,group:moderators,groups:moderators,admins) - 게시물 또는 주제 제목의 키워드 (예:
keywords:regression,bug,topic_keywords:feature,request) - 게시물 날짜 범위 (예:
after:2024-01-01 before:2024-06-30) - 주제 날짜 범위 (예:
topic_after:2024-01-01 topic_before:2024-06-30) - ID로 특정 주제 (예:
topic:123또는topics:123,456) - 주제 상태 (예:
status:open,status:closed,status:archived,status:noreplies,status:single_user) - 게시물 유형 (예:
post_type:first,post_type:reply) - 정렬 순서 (예:
order:latest,order:oldest,order:latest_topic,order:oldest_topic,order:likes) - 인라인 결과 제한 (예:
max_results:50) - 할당된 주제 (Assign 플러그인이 활성화된 경우, 예:
assigned_to:username,assigned_to:user1,user2,assigned_to:*,assigned_to:nobody) - 필터는 AND 논리(공백으로 구분) 또는 OR 논리(필터 그룹 사이에
OR사용)로 결합할 수 있습니다. 예:category:bugs status:open after:2024-05-01 OR tag:critical usernames:sally.
- 특정 카테고리 (예:
- 대규모 언어 모델(LLM)을 활용한 콘텐츠 분석: 필터링된 콘텐츠를 가져온 후, LLM을 사용하여 정보를 분석하고, 인사이트를 추출하며, 사용자의 특정 질문에 답하거나 연구 목표를 달성합니다.
- 구조화된 프로세스 준수: 특히 잠재적 비용을 고려하여 효율성과 정확성을 보장하기 위해, 포럼 리서처는 다음과 같이 설계되었습니다:
- 이해(Understand): 처음에 연구 목표를 명확히 하기 위해 사용자와 함께 작업합니다.
- 계획(Plan): 사용자의 목표에 기반하여 사용 가능한 필터를 활용하여 포괄적인 연구 접근법을 설계합니다.
- 테스트(Dry Run): 전체 분석을 실행하기 전에, 에이전트는 일반적으로 "드라이 런(dry run)"을 수행합니다. 이는 LLM으로 즉시 처리하지 않고 필터 기준에 해당하는 게시물의 수를 계산하는 것입니다. 이후 에이전트는 이 수를 사용자에게 알려줍니다.
- 정제(Refine): 드라이 런 결과에 기반하여, 게시물이 너무 많을 경우(높은 비용 또는 과도하게 광범위한 결과의 위험) 또는 너무 적을 경우(주요 정보 누락 가능성) 에이전트는 필터를 조정하는 데 도움을 줄 수 있습니다.
- 실행(Execute): 드라이 런 후 범위가 적절하다고 확인되면, 에이전트는 콘텐츠를 LLM으로 전송하여 최종 분석을 실행합니다.
- 요약(Summarize): 결과를 제시하며, 일반적으로 Discourse 마크다운을 사용하고, 원본 포럼 게시물 및 주제로의 링크를 보조 증거로 포함합니다.
이러한 체계적인 접근 방식 덕분에 리서처에게 다음과 같은 작업을 요청할 수 있습니다:
- “지난 분기에 ‘mobile-app’ 카테고리에서 가장 자주 논의된 미해결 버그를 요약하고, 토론에서 언급된 제안된 해결책 또는 우회 방법을 식별해 주세요.”
- “‘New User Onboarding’ 제안 주제(링크)에 대한 주요 찬반 논거를 식별하고, 각 측의 주요 지지자들을 나열해 주세요.”
- “지난 1년간 ‘documentation-team’ 그룹의 활동을 검토하고, how-to 게시물에 대한 주요 기여에 대한 보고서를 제공하며, 상당한 긍정적 피드백을 받은 튜토리얼을 강조해 주세요.”
포럼 리서처 설정
포럼 리서처는 사용 시 LLM 비용이 발생할 수 있으므로 기본적으로 비활성화되어 있습니다.
- 에이전트 활성화: Admin → AI → Agents로 이동하여 활성화합니다.
- 액세스 제어: LLM 비용을 관리하기 위해 이 에이전트를 특정 그룹으로 제한하는 것이 강력히 권장됩니다. 더 세밀한 제어를 위해 AI 할당량(AI quotas)을 사용할 수도 있습니다.
활성화되면, 이 도구는 여러 가지 설정 옵션을 제공합니다:
- LLM: 연구를 위한 특정 LLM을 선택합니다. 기본값은 현재 에이전트의 LLM입니다. 이 옵션을 통해 품질과 비용을 균형 잡을 수 있습니다.
- 최대 결과 수: 비용을 제어하기 위해 쿼리당 처리할 게시물 수를 제한합니다. 기본값은 1000입니다.
- 비공개 포함: 상호작용하는 사용자의 권한을 사용하여 보안 카테고리에서 검색할 수 있게 합니다.
- 게시물당 최대 토큰 수: 토큰 비용을 절약하기 위해 긴 게시물을 잘라냅니다. 기본값은 2000 토큰이며, 최소값은 50입니다.
- 배치당 최대 토큰 수: LLM으로 전송되는 데이터 청크 크기를 제어합니다. 큰 컨텍스트 윈도우를 가진 LLM에 유용하거나 집중력을 유지하는 데 도움이 됩니다. 8000 이하로 설정되면, LLM의 최대 프롬프트 토큰에서 2000 토큰 버퍼를 뺀 값으로 기본 설정됩니다.
상호작용 모범 사례
비용을 관리하면서 포럼 리서처를 최대한 활용하려면:
- 목표를 구체적으로 명시하세요: 시작 이전에 무엇을 알고 싶은지 명확히 정의하세요. 에이전트는 정확한 목표가 있을 때 가장 잘 작동합니다.
- 드라이 런 후 범위 확인: 에이전트는 일반적으로 먼저 '드라이 런’을 수행하고 요청에 기반하여 발견한 게시물 수를 알려줍니다. 이 숫자에 주의를 기울이세요. 너무 높으면(높은 비용 또는 초점이 흐려진 결과의 위험) 또는 너무 낮으면(중요한 정보 누락 가능성), 전체 분석을 실행하기 전에 에이전트와 필터를 정제하는 것에 대해 논의하세요.
- 필터 반복 조정: 초기 드라이 런이 올바른 정보를 대상으로 하지 않는다면, 에이전트와 함께 필터 기준을 조정하세요. 더 구체적인 키워드를 추가하거나, 날짜 범위를 좁히거나, 카테고리/태그를 지정하세요.
- 쿼리 통합: 에이전트는 단일 연구 실행에서 여러 관련 목표를 처리하도록 설계되었습니다. 관련 질문을 하나의 포괄적인 연구 요청으로 그룹화해 보세요.
표준 포럼 헬퍼 및 관련 도구와의 관계
포럼 리서처 에이전트는 Search와 Read와 같은 표준 도구를 사용하는 일반 포럼 헬퍼와 구별됩니다.
-
표준
Search및Read도구:Search도구는 주로 관련 주제를 식별합니다. 이는 게시물 콘텐츠 및 기타 기준(태그, 카테고리 등)과 키워드를 일치시켜 수행됩니다. 각 일치하는 주제에 대해, 전체 게시물 콘텐츠가 아닌 관련 게시물에서 가져온 링크와 짧은 스니펫을 반환합니다.Read도구는Search가 식별한 특정 주제(또는 그 안의 선택된 게시물)의 전체 콘텐츠에 액세스하는 데 사용됩니다.- 이러한 도구는 대상적인 검색을 위해 함께 작동합니다:
Search는 주제를 찾고,Read는 그 내용을 소화합니다.
-
포럼 리서처의
researcher도구:- 직접적이고 심층적인 콘텐츠 분석:
researcher도구는 주제를 식별하는 것뿐만 아니라, 포괄적인 필터 기준에 해당하는 여러 게시물의 전체 콘텐츠(설정된최대 결과 수까지)를 직접 처리하고 분석합니다. - 고급 필터링 및 종합: 포럼 전체에서(수백 개의 주제에 걸쳐) 게시물의 데이터셋을 구축하기 위해 더 복잡한 필터링 언어를 사용하고, 이 전체 데이터셋에서 정보를 종합하여 복잡한 질문에 답합니다. 이는 개별 주제를 하나씩 읽는 것과 근본적으로 다릅니다.
- 직접적이고 심층적인 콘텐츠 분석:
요약하자면, 포럼 헬퍼가 Search를 사용하여 주제를 특정하고(스니펫을 표시) Read를 사용하여 하나를 깊이 파고드는 반면, 포럼 리서처는 더 깊고 종합적인 인사이트를 발굴하기 위해 여러 게시물의 실제 텍스트에 걸쳐 광범위한 분석을 동시에 수행합니다.
어떤 LLM을 사용해야 하나요?
LLM 기술은 빠르게 발전하고 있으며, 모델들은 기능과 비용 효율성 면에서 지속적으로 개선되고 있습니다. 포럼 리서처 개발 동안, Gemini 2.5 Flash, Gemini 2.5 Pro, GPT-4.1, Claude 4 Sonnet과 같은 모델들은 복잡한 연구 계획에 대해 훌륭한 결과를 제공했습니다.
최선의 선택은 사용자의 특정 필요에 따라 달라집니다:
- 고품질, 세심한 분석: 더 고급 모델이 선호될 수 있지만, 일반적으로 더 높은 비용이 수반됩니다.
- 광범위한 개요 또는 비용 민감형 작업: 더 빠르고 경제적인 모델이 매우 효과적일 수 있습니다.
다음은 Discourse 내부 테스트에서 매우 구체적이고 복잡한 쿼리에 대한 시점별 예시입니다:
기능 카테고리의 상위 1000개 열린 주제를 살펴보세요 - 좋아요 순서(첫 게시물만) - 모든 기간 … 다음에 대한 경영진 보고서를 작성해 주세요:
- CDCK가 구축해야 할 상위 20개 기능
- CDCK가 가장 쉽게 구축할 수 있는 20개 기능
- 명백한 중복 항목
- 정의가 매우 불분명한 항목
더 이상 질문하지 말고, 연구를 실행해 주세요
- Gemini 2.0 Flash 예시
- Gemini 2.5 Flash (thinking 포함) 예시
- GPT-4.1 예시
- Claude 4 Sonnet 예시
- Gemini 2.5 Pro 예시
하이브리드 예시: 드라이버는 Gemini 2.5 Pro, 리서처 LLM은 Gemini 2.0 Flash
하이브리드 예시
연구 디버깅
Discourse에서는 ai_bot_debugging_allowed_groups 사이트 설정에 그룹을 추가하여 고급 AI 디버깅을 활성화할 수 있습니다. 이렇게 하면 LLM으로 전송되는 실제 페이로드를 볼 수 있습니다.
한계
현재 연구 LLM에 이미지를 전송하는 옵션은 없습니다. 이는 향후 버전에서 고려될 것입니다.
FAQ
-
포럼 리서처는 모든 Discourse 플랜에서 사용 가능한가요?
포럼 리서처는 Discourse AI 플러그인의 일부이며, 셀프 호스팅 사이트와 Enterprise 호스팅 플랜에서 사용할 수 있습니다. -
포럼 리서처가 보안 카테고리의 콘텐츠에 액세스할 수 있나요?
네, 설정에서 “비공개 포함” 옵션이 활성화되어 있고 에이전트와 상호작용하는 사용자가 해당 카테고리에 액세스할 권한이 있는 경우 가능합니다. -
포럼 리서처 사용 비용을 어떻게 제어할 수 있나요?
- 액세스를 특정 신뢰할 수 있는 그룹으로 제한합니다.
- “최대 결과 수” 및 “게시물당 최대 토큰 수” 설정을 사용하여 처리를 제한합니다.
- 비용 효율적인 LLM을 선택합니다.
- 전체 연구를 실행하기 전에 “드라이 런” 추정치에 주의를 기울입니다.
- AI 할당량을 활용합니다.



