Los gateways miden el tráfico de IA. Gesta observa el comportamiento de los agentes.
Tu gateway responde bien una pregunta: quién llamó a qué modelo, y cuándo. Las preguntas que determinan presupuestos, auditorías y revisiones de incidentes — qué hizo el agente, qué produjo, cuánto costó realmente — solo existen en el endpoint, donde se ejecuta el agente.
Dos partidas no pueden calcular el precio de un agente.
Los informes de costo del gateway multiplican dos números: tokens de entrada y tokens de salida. Las sesiones de agente repiten el mismo contexto en cada turno — así que los tokens que dominan la factura son justamente los niveles de caché que la aritmética del gateway nunca ve.
POST /v1/messages 200 model frontier-large input_tokens 1,842 output_tokens 697 — — — — — — — — — — — — — — cost = in × rate + out × rate = $0.016
Las cargas de trabajo de los agentes están dominadas por la caché. Si solo se cobran entrada y salida, la factura está mal desde el primer dígito. Gesta valora cada nivel de token.
Los datos mostrados son ilustrativos
El gasto no es producción.
Un proxy ve tráfico — solicitudes, bytes, latencia. Y los tokens de salida del modelo tampoco son producción: la mayor parte de una sesión es el agente pensando, leyendo, reintentando. Nada en un registro de solicitudes conecta un dólar de gasto con el trabajo realmente producido.
14:02:11 POST /v1/messages 200 2.1 MB 1,204 ms 14:02:19 POST /v1/messages 200 3.4 MB 980 ms 14:02:31 POST /v1/messages 200 1.7 MB 644 ms 14:02:48 POST /v1/messages 200 2.9 MB 1,411 ms — — — — — — — — — — — — — — requests 2,417 · bytes out 1.9 GB
- Código producido412 líneas
- Pruebas producidas96 líneas
- Documentación producida1,024 palabras
- Herramientas externas17 llamadas MCP
- Costo de la sesión$12.40
Un proxy sabe cuánto gastaste. No puede saber qué obtuviste. Gesta mide lo que los agentes realmente producen — y un agente local que escribe archivos nunca pasa por un proxy.
Los datos mostrados son ilustrativos
Un registro de solicitudes no es una traza de auditoría.
Cuando llega la auditoría, “alguien llamó a un modelo a las 09:41” no es una respuesta. Y un agente que habla con una herramienta local o llama directamente a una API nunca pasa por tu proxy — el registro del gateway no tiene ninguna fila que mostrar.
09:41:07 key prod-07 POST /v1/messages 200 demuestra: alguien, con esta clave, llamó a un modelo a las 09:41. no puede responder: • ¿esta línea de código la escribió una IA? • ¿qué salió en el cuerpo del prompt? • ¿y las llamadas que nunca pasaron por el gateway?
Los registros de solicitudes prueban que alguien llamó a un modelo. No pueden decirte si una línea de código la escribió una IA, ni si los datos del cliente salieron en un prompt que nunca tocó tu gateway. Esas respuestas solo existen donde se ejecuta el agente. Ahí es donde está Gesta.
Los datos mostrados son ilustrativos