other30 de julio de 2026Edición #68

El impuesto LLM en cada llamada de orquestación

Martin Fowler está escribiendo sobre algo que la mayoría ha sentido pero no ha nombrado: cada vez que una capa de chatbot se sienta entre el usuario y una herramienta real —un motor de búsqueda, una base de datos, un code runner—, el LLM tiene que decidir si las palabras del usuario están listas para pasar. Esa decisión cuesta tokens, y los tokens cuestan dinero. Cuantas más capas apiles, más pagas.

El costo real no es la llamada del LLM en sí. Son las llamadas que dispara. Un orquestador que busca una definición, luego consulta una base de datos, y luego formatea una respuesta dispara tres llamadas LLM por lo que un humano haría con una. Cada una quema tokens. Cada una añade latencia. La factura se compila en silencio.

Por qué nos importa: cada app que los primos están construyendo sobre LLMs está pagando silenciosamente este impuesto —y la mayoría no lo sabe todavía, así que están cobrando mal.

El costo real no es la llamada del LLM en sí. Son las llamadas que dispara.

martinfowler.com

Lee el originalAbrir en pestaña nueva
#llm_cost#orchestration#infrastructure#fowler

Boletín diario · sin spam

Recibe el diario en tu puerta

Un correo corto al día — IA, tecnología y lo que significa para nuestras comunidades. Lenguaje claro, mirada cultural, sin jerga de Silicon Valley.