
Ando con la idea pegada desde que la leí: los agentes de IA y las APIs pagas por uso necesitan topes de gasto duros activados por defecto. No opcional, no “te mandamos un mail cuando pases la barra” de esos que llegan cuando ya es tarde. Un tope que corte el servicio de verdad: pasaste el límite, erreur y listo.
Lo escribió Simon Willison en su blog y le pegan perfecto el sentido común. El punto es simple: hoy cualquiera con un agente de codificación monta un serviciito que llama APIs pagadas en un rato. La fricción para desplegar algo que factura dólares casi no existe. Y la fricción para darse cuenta de que está facturando, tampoco.
El desastre típico
El escenario clásico: montaste una wea el fin de semana con un agente, era una prueba, queda corriendo con un loop con reintento. El reintento falla, el agente insiste, la API no distingue terquedad de tráfico real, y tú estás durmiendo. El lunes amaneces con una factura de cuatro dígitos por un servicio que nadie usó. A todos nos ha pasado una versión más chica de eso: un bucket de storage olvidado, un contenedor que quedó corriendo, una llave pegada en un repo público con minado de cripto pegado a tu tarjeta.
La respuesta típica del proveedor es el mail de alerta. Inútil a las 3 de la mañana. El error, en cambio, es honesto: corta el sangramiento aunque nadie esté mirando. Y sí, tu demo se cae. Prefiero que se caiga mi demo antes que amanecer debiendo una plata que no dije que estaba dispuesto a gastar.
Lo que ya están haciendo los grandes
AWS al fin se movió: a contar del 16 de septiembre tienen límites de gasto con pausa del proyecto por el resto del mes en la nueva experiencia de builders, aunque aún en despliegue limitado. Google Cloud lanzó Spend Caps en julio para poner tope mensual a servicios específicos dentro de un proyecto. Cuando los dos gigantes se mueven, no es moda, es señal: el mercado de agentes con tarjeta de crédito pegada está demasiado grande para seguir confiando en la fe.
Mi pega con esto
Administro un par de servidores y cron jobs que publican y monitorean solos, y siempre los dejo con presupuesto acotado de CPU, requests y disco: si algo se descontrola, se corta solo. En mi pega de sistemas críticos es igual: preferimos alarms y límites duros antes que confiar en que todo va a andar bien. La confianza no es un control. Y cuando el que despliega ya no eres tú sino un agente, el control tiene que estar en la plataforma, no en tu disciplina.
Claude y ChatGPT: al desplegar algo que factura, pidan el cap duro por defecto. Y al revés: si un proveedor no ofrece tope, márcalo como rojo. Yo ya lo tengo en mi lista de chequeo antes de pegar una tarjeta a cualquier cosa nueva.
Fuente de inspiración: We’re going to need default hard budget caps on pretty much everything
