Usar Discourse MCP para crear rápidamente un tema

,

Ejecuté una prueba con DeepSeek 4.1 flash max.

La transcripción completa está aquí: https://gisthost.github.io/?28dedf78da999ccca5b5b4feb1d58fc9/index.html

Esto estuvo un poco contaminado, ya que ejecuté la prueba en un contenedor de dv y en algún momento el agente decidió que sería más eficiente usar Docker para hacer los cambios en lugar de apoyarse en nuestro MCP.

Para la generación de imágenes usé Qwen 3 Image.

Para la inspección visual, le di al agente chrome-devtools-mcp. Esto se puede configurar fácilmente para usar Chromium en Linux, que suele ser mi elección:

   "chromium-devtools": {
      "command": "npx",
      "args": [
        "-y",
        "chrome-devtools-mcp@latest",
        "--headless=true",
        "--executable-path=/usr/bin/chromium",
        "--chrome-arg=--no-sandbox",
        "--chrome-arg=--disable-dev-shm-usage"
      ]
    },

Toda la ejecución se basó en DeepSeek 4.1 flash tanto para el agente principal como para los subagentes.

Usé term-llm.com para controlarlo en modo TUI:

Resultados:

Observaciones

El briefing es crítico: si tienes un buen briefing, los resultados serán excelentes; si tienes un briefing deficiente, quedas a merced del LLM. Un gran briefing habla sobre la estructura, los colores y da ejemplos, entre otras cosas.


DeepSeek 4.1 flash fue muy capaz en esta prueba y muy barato. Con un 99% de lectura de caché y solo 2,8 M de tokens leídos, esto habría costado alrededor de $1,52 fuera de hora punta o $3,04 en la tarifa de hora punta. Astra es significativamente más eficiente en tokens, por lo que esto no es justo, pero para ponerlo en contexto, el precio de Astra para un número similar de tokens sería de $325.

De manera conservadora, incluso teniendo en cuenta la eficiencia de tokens, estimaría que podrías lograr un diseño como este en Astra por 50-100 dólares; conseguirlo por 1,50 dólares es imposible con los costos actuales de la API.

Ejecuté esto en mi plan OpenCode go y ni siquiera sentí un pequeño golpe en mi plan de $10 al mes:

Algunas cosas me impresionaron de esta ejecución: fue capaz de funcionar de forma desatendida durante horas. Actuó sobre el MISMO briefing exacto de el OP diligentemente y con cuidado. Intentó abordar cada punto del briefing y probó meticulosamente todo.

Acertó en muchas cosas y el diseño es sólido.

Dicho esto, esto no es GPT 6 Astra; el diseño me parece más propio de un LLM. El espaciado, las fuentes y la atención al detalle no eran los mismos que en Astra. También es muy claro que no tiene la misma fidelidad visual que Astra; hubo muchos fallos visuales evidentes después de la iteración 1, aunque, a su favor, fue capaz de corregir la mayoría cuando se le solicitó.

Se negó a corregir este en particular por alguna razón:

Pero el resto de las peculiaridades fueron manejadas sin problema por él.

La parte más impresionante de la construcción fue lo ordenado que insistió en ser:

  • Creó una carpeta para la evidencia
  • Intentó ingenierizar el tema de manera limpia, dividiéndolo en muchos archivos e incluso probarlo

En general, no esperes Astra de un modelo 50/100 veces más barato, pero como herramienta, sin duda puede producir resultados muy interesantes por una fracción del costo.

En retrospectiva, recomendaría construir el tema directamente en un contenedor dv y luego subirlo, ya que puedes ejecutarlo de forma segura en modo YOLO y la configuración es muy fácil.


Intentaré hacer algunas experimentos más al respecto la próxima semana y publicaré algunos ejemplos más. Si tienes un briefing espectacular, avísame.

Generalmente uso múltiples LLMs de múltiples proveedores para construir cosas, así que un ejemplo más tipo “cómo trabajo generalmente” podría ser interesante.

8 Me gusta