Los precios de los tokens para modelos de lenguaje grande han colapsado desde aproximadamente $20 por millón de tokens a fines de 2022 a unos $0,40 hoy – una disminución del 98%. Paradójicamente, el gasto en inteligencia artificial empresarial ha explotado, con análisis de la industria que estiman un aumento del 320% en las facturas desde la caída del precio. El aumento se debe a la adopción rápida de herramientas de inteligencia artificial que multiplican el consumo de tokens por tarea.

Anthropic’s Claude Opus 4.5, OpenAI’s GPT-5.1 y Google’s Gemini 3 Pro, lanzados después de noviembre de 2025, han convertido flujos de trabajo de un solo paso en sistemas de inteligencia artificial orquestados. Donde una interacción lineal costaba $0,04 en 2023, el mismo proceso ahora cuesta aproximadamente $1,20 – un salto de treinta veces. El uso de tokens por desarrollador ha aumentado alrededor de 18,6 veces en nueve meses, según Nicholas Arcolano, jefe de investigación en Jellyfish. Los usuarios intensivos de tokens informan ganancias de productividad pero gastan diez veces más tokens que los usuarios más ligeros.

El gasto excesivo ya es una realidad. Uber agotó todo su presupuesto de codificación de inteligencia artificial para 2026 en abril. Microsoft revocó las licencias de Claude Code para los desarrolladores seis meses después de otorgarlas. Una empresa no identificada acumuló una factura de $500 millones por Claude en un solo mes después de olvidar establecer límites de uso. El director financiero senior de IT de Priceline, Chris Reed, dijo que una renovación de contrato rutinaria con la herramienta Cursor devolvió cuatro a cinco veces el costo anterior.

“Seis meses atrás, tendría una conversación con un cliente sobre ‘¿Qué puede hacer?’ Hoy es ‘Estamos gastando tanto. ¿Qué visibilidad tenemos?’” dijo Alexander Embiricos, jefe de empresa de OpenAI. J.R. Storment, director ejecutivo de la Fundación FinOps, hizo eco del cambio: “La conversación pasó de token-maxxing y ‘ir rápido’ a ‘necesitamos guardrails, ¿cómo controlamos esto?’”

Para abordar la creciente presión financiera, la Fundación Linux presentó planes para la Fundación Tokenomics. El nuevo organismo de estándares tiene como objetivo definir “tokenomía”, publicar estándares abiertos para el uso y la facturación de tokens de inteligencia artificial, e introducir métricas como costo por inteligencia y tokens por vatio. Un lanzamiento formal está programado para julio. Nishant Gupta, oficial de disponibilidad chief en Salesforce, advirtió que “la economía de tokens es fundamentalmente más abstracta y opaca que cualquier cosa que hayamos administrado a esta escala antes”.

Los jugadores de la industria ya están compitiendo para llenar el vacío. Empresas emergentes como Pay-i y Paid ofrecen optimización de gastos de inteligencia artificial y facturación basada en valor. Empresas como Jellyfish, Waydev y Faros AI proporcionan monitoreo para demostrar el retorno de la inversión en herramientas de desarrollador. Plataformas de observabilidad más grandes – Datadog y New Relic – han agregado métricas de nivel de token. El enrutamiento de modelos está surgiendo como un principal control de costos; Factory, una empresa emergente de codificación de inteligencia artificial, introdujo un enrutador que selecciona automáticamente el modelo más barato adecuado para cada tarea.

Goldman Sachs proyecta que el uso global de tokens se multiplicará por 24 para 2030. Para las empresas que ya están por encima del presupuesto, se necesitan soluciones ahora, incluso si los primeros entregables de la Fundación Tokenomics aún están meses por delante. Como lo expresó Vitaly Gordon, CEO de Faros AI, “Quizás creamos una máquina de vapor, pero todavía no hemos descubierto la línea de montaje”.

Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.