El consumo de tokens en OpenRouter crece un 25.000% y reaviva el debate sobre la burbuja de la IA

Hecho Qué ha ocurrido
El consumo semanal de tokens en OpenRouter pasó de 0,5 a 126,2 billones entre enero de 2025 y septiembre de 2026, un aumento superior al 25.000%. El artículo atribuye este salto a modelos de razonamiento que generan grandes cantidades de tokens de 'pensamiento' y a agentes de IA sin optimizar que consumen tokens de forma ineficiente. GPT 5.6 Luna de OpenAI lidera el consumo de tokens, mientras que Astra lidera en ingresos; modelos chinos como Kimi, GLM y DeepSeek multiplicaron por diez su gasto mensual en 2026.
Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: análisis u opinión.
Análisis Por qué importa
El dato desmonta la idea de que más tokens equivale a más adopción real o valor de negocio, lo que es clave para interpretar correctamente las métricas de crecimiento de IA que circulan en el mercado. Para directivos, sugiere que el gasto en inferencia puede dispararse sin un retorno proporcional si los agentes no están bien diseñados.
- Quién se ve afectado
- Empresas que despliegan agentes de IA, equipos de IT y finanzas que gestionan presupuestos de inferencia, y analistas de mercado que evalúan el crecimiento del sector.
- Qué puede cambiar
- Las empresas deberán auditar la eficiencia de tokens de sus agentes y modelos de razonamiento antes de escalar su uso, ya que el coste puede crecer mucho más rápido que el valor generado.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si OpenRouter u otras plataformas publican métricas de eficiencia por tarea (no solo tokens totales) y si las empresas empiezan a optimizar agentes para reducir consumo innecesario.
Recomendación Qué debería hacer una empresa
Las empresas que operan agentes de IA deberían auditar en los próximos 3-6 meses el consumo de tokens por tarea para detectar ineficiencias antes de escalar el gasto en inferencia.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: The Decoder. La referencia es siempre el artículo original.
Ver fuente original ↗LLMagentesrazonamiento OpenRouterOpenAIDeepSeek agentes IAburbuja de IAGPT-5.6OpenRoutertokens
Tu opinión
0 comentarios
Relacionadas
Apple estudiaría volver al mercado de servidores para IA con chip M8 Ultra y NVLink de Nvidia
The Information informa que Apple lleva alrededor de un año explorando un proyecto de servidores comerciales para IA, basado en chips M8 Ultra e interconexión…
Por qué importaSi se confirma, marcaría el regreso de Apple al negocio de servidores empresariales tras el fin de Xserve en 2011, esta vez orientado a inferencia y…
Treble, startup islandesa de simulación acústica para IA de voz, capta 18 millones de dólares
Treble, startup islandesa fundada en 2020, ha recaudado 18 millones de dólares en una extensión de su Serie A liderada por Paladin Capital Group, superando los…
Por qué importaEl caso ilustra cómo la infraestructura de datos y testing especializado (aquí, física acústica simulada) se está convirtiendo en un cuello de…
Apple estudiaría reingresar al mercado de servidores con chips propios y tecnología NVLink de Nvidia
Según The Information, Apple evalúa desarrollar servidores corporativos para inferencia de IA con chips M8 Ultra propios, integrando la tecnología NVLink…
Por qué importaMarcaría el regreso de Apple al mercado de servidores tras 15 años y una colaboración inédita con Nvidia, un competidor potencial en infraestructura…
Apple prepararía servidor con múltiples chips M-series Ultra para IA con lanzamiento en 2029
Según The Information, Apple está desarrollando un servidor empresarial con dos o cuatro chips M8 Ultra, con lanzamiento previsto para 2029. Sería el primer…
Por qué importaIndica que Apple busca capturar parte del mercado empresarial de infraestructura de IA, aprovechando la creciente adopción de Mac Studio y Mac mini…



