EmAGI
Español
Documentación · índice

Gasto de tokens: qué lo hace crecer

Diagrama: el recorrido de un mensaje; cada paso queda registrado, así que el gasto se ve paso a paso.

Pagas un plan de tarifa plana, pero la suscripción de IA que hay detrás de tu agente tiene un presupuesto de uso. Estas tres cosas lo consumen más rápido.

1. Cadenas largas de trabajo

Cada paso de una tarea larga vuelve a leer todo lo anterior. Un trabajo de veinte pasos cuesta mucho más que veinte preguntas cortas por separado.

2. Material voluminoso

Leer un documento largo, un historial de chat grande o muchas páginas web es lo más caro que hace un agente. Indícale el archivo o la página concretos en lugar de "todo lo que hay en la carpeta".

3. Reglas muy largas

Las instrucciones que le das al agente se releen en cada paso. Una página de reglas se paga una y otra vez. Mantenlas cortas y centradas en el comportamiento, como "confirma siempre antes de escribir a un cliente", en lugar de largas listas de casos concretos.

Qué no ayuda

Reiniciar el agente no ahorra nada; al contrario, cuesta, porque el agente tiene que volver a cargar su contexto. Borrar el historial tampoco ayuda: la memoria permanente es lo que hace útil al agente, y buscar en ella es barato.

¿Dónde veo las cifras?

El panel muestra el gasto por agente y por chat, con un selector de periodo. Si un chat es caro de forma constante, ese es el que hay que cambiar, normalmente dividiendo una tarea larga en temas separados.