AI 봇 및 AI Helper의 사용자 그룹 AI 사용량에 대한 하드 캡 기능 도입의 필요성

일부 계산을 해본 결과, 사용자의 월별 또는 일별 토큰 입력 및 출력을 제한할 수 있는 기능이 없으면 빠르게 문제가 생길 수 있다는 결론에 도달했습니다. 현재 AI 봇과의 사용자 상호작용을 제한하는 유일한 방법은 AI 봇을 개인 메시지(PM)에서만 허용하는 것(각 페르소나에 대한 채팅 비활성화)과 일일 허용 PM 수를 설정하는 것입니다. 하지만 물론 이는 비현실적입니다. OpenAI가 ChatGPT 멤버들에게 적용하는 방식을 참고하여, 이 기능의 필요성을 정당화하는 “최악의 시나리오” 비용 분석 예시를 다음과 같이 제시합니다:

GPT-4o mini, 32k 컨텍스트 (참고: 컨텍스트 길이는 LLM 설정 페이지의 “프롬프트용 토큰 수” 설정을 통해 지정됩니다)

현재 비용: 입력 100만 토큰당 $0.15 / 출력 100만 토큰당 $0.60

사용자가 매일 32k를 입력하고 16k를 출력하며, 이를 30일(일반적인 구독의 한 결제 주기) 동안 지속한다고 가정해 보겠습니다:

월별 입력 비용 = 960,000 토큰 = 약 $0.14

월별 출력 비용 = 480,000 토큰 = 약 $0.28

음, 실제로는 나쁘지 않네요, 그렇죠? 반 달러도 안 됩니다. 하지만 이는 상당히 낮은 사용량입니다. 특히 GPT-4o mini는 한 번에 최대 16.4k 토큰까지 생성할 수 있기 때문이죠(물론 프롬프트와 LLM 설정을 조정하여 이를 방지할 수는 있습니다). 사용자가 AI 봇을 얼마나 많이 사용할 것으로 생각하는지에 따라 이러한 비용을 곱해 볼 수 있습니다. 가장 나쁜 점은 이 모델이 incredibly 저렴하다는 것입니다. Claude 3.5 Sonnet(입력 100만 토큰당 $3 / 출력 100만 토큰당 $15)과 GPT-4o(입력 100만 토큰당 $5 / 출력 100만 토큰당 $15)의 경우 비용은 지수적으로 더 높습니다 — GPT-4 Turbo에 대해서는 언급조차 하지 않겠습니다. 다음은 Claude 3.5 Sonnet에 대한 동일한 분석입니다:

Claude 3.5 Sonnet, 32k 컨텍스트

월별 입력 비용 = 약 $2.88

월별 출력 비용 = 약 $7.20

합계 = 약 $10.08

하지만 다시 한번 말씀드리지만, 이는 낮은 사용량입니다. 따라서 AI 봇에서 LLM 사용에 제한이 없을 경우 얼마나 비용이 많이 들 수 있는지가 명확해집니다. 이 값을 2로 곱한다면, 약 $5의 이윤을 남기려면 $25의 구독료를 부과해야 합니다 :grimacing:

:bullseye: 제가 공식적으로 제안하는 내용은 다음과 같습니다:

  1. AI 봇의 경우, 특정 사용자 그룹에 대해 월별 또는 일별 특정 양의 토큰 입력과 출력을 허용하는 설정.
  • 이 토큰 사용량에는 페르소나의 시스템 프롬프트가 포함되지 않아야 합니다.
  • 토큰 한도는 LLM별, 페르소나별, 또는 전체/보편적으로 설정할 수 있어야 합니다.
  1. 1번 항목의 대안으로, DM과 PM에서 AI 봇을 사용할 때의 간단한 정수 한도를 사용할 수 있습니다. 예: 페르소나당 하루 100개의 DM 제한.
  2. AI 헬퍼의 경우, 특정 사용자 그룹에 대해 월별 또는 일별 특정 양의 토큰 출력을 허용하는 설정.
  • 긴 토픽이 몇 토큰인지 사용자가 추측하는 것은 비현실적이므로(예: 요약 생성 시), 토큰 입력은 계산에서 제외해도 무방합니다.
  • 사용자가 Composer를 미터링되지 않은 채팅봇으로 사용하여 월별/일별 한도를 우회하려는 시도를 하지 않도록, 커스텀 프롬프트의 길이(단위로, 여기서 TikToken을 사용하지 않도록 하기 위함)에 대한 하드 정수 한도를 두는 것도 현명할 수 있습니다 :smiling_face_with_sunglasses:
  1. 사용자 프로필과 어쩌면 PM 및 DM 안에서도 표시되는 토큰 카운터. 각 사용자 및 AI 메시지 옆에 해당 메시지의 토큰 수를 표시하는 작은 텍스트가 있다면 좋겠습니다(모두에게 디버그 기능을 허용하고 싶지는 않고, 어쨌든 그것은 PM에서만 작동합니다)
  • AI 헬퍼용 별도의 토큰 카운터(이 두 기능을 분리하여 유지하는 데 도움이 됨)로, 설명, 교정, 커스텀 프롬프트 등이 카운트를 공유하도록 하는 것이 좋습니다.

부연 설명: 저는 이 기능이나 개발자들을 전혀 비판하는 것이 아니며, 이 글이 그렇게 읽힌다면 죄송합니다. 솔직히 Discourse AI 플러그인은 제가 지금까지 사용해 온 기술 중 최고 중 하나입니다. 실제로, 이 기능 덕분에 저는 AI 연구자 및 교육자로서 제 꿈의 사업을 구축할 수 있으며, 추가 엔지니어를 고용하거나 추가 인프라 비용을 지불할 필요가 없습니다 — 모든 것을 혼자서 설정할 수 있습니다 :heart:. 저는 이 기능이 저뿐만 아니라, 이 훌륭한 기술을 합리적인 범위 내에서 사용자들에게 즐길 수 있게 하고자 하는 수많은 다른 Discourse 사용자들에게 퍼즐의 마지막 조각이라고 생각합니다.

1개의 좋아요

This was implemented in Discourse Chatbot as a weekly quota system in March '23 and has since been expanded so you can define quotas for three different collections of user Groups. E.g. Paying members get a higher quota.

Users who breach their weekly quota are shown a polite message (which costs you nothing).

Moreover, the admins can be alerted when a quota is breached.

I did PM you about it in response to one of your prior Posts on this topic, but you didn’t respond :thinking: Perhaps you are hosted and don’t have access to my plugin?

tbh, with the advent of GPT 4o-mini the costs for decent bot conversations have plummeted.

btw, Discourse Chatbot is now used by at least one business for front line customer support, so you can be sure it is stable and effective.

2개의 좋아요

Apologies for the lack of a reply! I remember reading it now, but I have no idea why I didn’t write back :face_with_spiral_eyes:. And I’m on a droplet so that isn’t the issue.

I have no doubt about its stability and quality; in fact, I quite like the plugin and I respect you and the effort you put into it. However, a chatbot is only a partial need for my business venture. The AI Helper is a core necessity, as well as is the ability to immediately change between models. In the near future I will be deploying my own fine-tuned model and manually setting up my LLMs and this is mission-critical.

I’m only explaining all of this so that you don’t think I have something against your work! :grin: Rather, the problem is from my side; I’m trying to do something quite niche.

1개의 좋아요

Yep, fully respect the scope of the request is broader :+1:

Just offering a partial (if significant) solution.

1개의 좋아요

이번 주에 머지될 예정입니다:

6개의 좋아요

이건 정말 대단한데요!

아래 세부 내용에서, 이는 그룹 내 모든 사용자가 총 토큰 수와 요청 수를 공유한다는 의미인가요, 아니면 그룹의 각 사용자가 설정된 한도를 개별적으로 사용할 수 있다는 의미인가요?

이 시스템은 관리자가 그룹별로 총 토큰 수와 요청 수에 대한 한도를 정의할 수 있도록 하여 LLM API 사용에 대한 세밀한 제어를 제공합니다.

아, UI에서 이 부분을 명확히 해야겠네요… 모든 한도는 사용자별로 적용되며, 그룹 멤버 간에 공유되지 않습니다. 공유 그룹 할당량 한도는 흥미로운 개념이지만, 실제로 유용한지 확신이 안 드네요. 이런 기능이 유용할 수 있는 상황을 생각해 볼 수 있을까요?

현재 제 구현 방식은 다음과 같습니다:

  • 사용자가 속해 있는 그룹에 따라 가장 “완화된” 할당량을 선택합니다.
  • 사용자별로 한도를 적용합니다.

(이 방식은 TL2에 엄격한 할당량이 있어도 관리자에게 면책 권한을 부여합니다)

실제로는 의미가 없을 것 같아서 질문했습니다 :grinning_face_with_smiling_eyes: . 제 생각에는 여기 구현하신 방식이 가장 이상적입니다. 저희 커뮤니티와 저는 여기서 이루어지고 있는 작업에 진심으로 감사드립니다 :heart:

1개의 좋아요

"절대적 할당"에 대한 유일한 논거는 다음과 같습니다:

Tl1이 AI를 사용할 수 있도록 하되… 안전장치로 일일 지출을 N$로 제한하고 싶습니다. Tl1의 회원 수는 알 수 없습니다.

하지만 만약 그것이 사람들이 원하는 것이라면, Anthropic / OpenAI 등의 대시보드에 절대적 할당을 직접 설정할 수 있을 것입니다.

나중에 절대적 할당을 추가하는 것에 반대하지는 않지만, 이번 반복에서는 생략할 가능성이 높습니다.

2개의 좋아요

@sam 정말 멋진 업데이트네요 :partying_face: 토큰 한도가 구독과 연동될 예정인가요? 사용량을 관리하고, 비용을 지불하면 더 비싼 모델을 사용할 수 있다면 정말 좋을 것 같습니다.

네, 이 시스템에서는 작동할 수 있으며, 사용자 그룹별로 다른 할당량을 설정할 수 있습니다.

2개의 좋아요

이제는 구현 및 문서화가 완료되었습니다:

2개의 좋아요

이 주제는 5일 후 자동으로 닫혔습니다. 더 이상 답변을 게시할 수 없습니다.