# Costos de HuggingFace TGI vs OpenAI API Endpoint

**URL:** https://meta.discourse.org/t/huggingface-tgi-vs-openai-api-endpoint-costs/347106
**Category:** Support
**Tags:** ai
**Created:** [14 Enero, 2025 17:24 UTC](https://meta.discourse.org/t/huggingface-tgi-vs-openai-api-endpoint-costs/347106 "2025-01-14T17:24:41Z")
**Posts on this page:** 1
**Showing post:** 2

<div class="post-metadata">

### Author: ![Falco](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/falco/32/179432_2.png) [@Falco](https://meta.discourse.org/u/Falco)
#### Post date: [15 Enero, 2025 15:24 UTC](https://meta.discourse.org/t/huggingface-tgi-vs-openai-api-endpoint-costs/347106/2 "2025-01-15T15:24:11Z")

</div>

Para una instancia única, será difícil superar los precios de la API, ya que con los precios de la API pagas por llamada, mientras que al ejecutar TGI, pagas por hora que el servidor está en funcionamiento.

Digamos que estás ejecutando Llama 3.1 8B en un `g6.xlarge`; eso te costará aproximadamente $600 al mes. Esto podría darte alrededor de 450 millones de tokens en Anthropic Claude 3.5 Haiku.

Ejecutar tu propio LLM tiene sentido cuando necesitas privacidad o escala.

---

_[View the full topic](https://meta.discourse.org/t/huggingface-tgi-vs-openai-api-endpoint-costs/347106)._
