Ir al contenido
IA para hoy
Inversión y mercado Benchmark 2/5 · Declaración interesada

Estudios de Epoch AI y MIT muestran caídas de 13x y 3x anuales en el coste de igualar el rendimiento de IA

Estudios de Epoch AI y MIT muestran caídas de 13x y 3x anuales en el coste de igualar el rendimiento de IA
Foto: Rafael Minguet Delgado · Licencia Pexels · Pexels

Hecho Qué ha ocurrido

Epoch AI calcula que el coste de alcanzar un nivel fijo de rendimiento en benchmarks de IA cae un 47% por trimestre, unas 13 veces al año, más rápido que cualquier tecnología transformadora previa. Investigadores del MIT, usando datos de Artificial Analysis, estiman una caída de 5x a 10x anual, y tras descontar el abaratamiento del hardware y la presión competitiva, sitúan la mejora algorítmica pura en unas 3x al año. Epoch pone como ejemplo que un modelo de la familia GPT-5.6 igualó en 2025 un 75% en GPQA Diamond que o3 lograba por 30 centavos, pero por cuatro centésimas de centavo, una reducción de 1/725. El MIT advierte que los modelos de razonamiento más nuevos pueden costar más por consulta al usar mucho más cómputo por tarea.

Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: análisis u opinión.

Análisis Por qué importa

Para las empresas que eligen modelos de IA, entender esta dinámica evita decisiones basadas solo en el precio por token, ya que el modelo más barato no siempre es el más eficiente en coste real por tarea resuelta.

Quién se ve afectado
Equipos de IT, desarrollo y responsables de compras tecnológicas que evalúan y presupuestan el uso de modelos de IA en producción.
Qué puede cambiar
La comparación de modelos debe basarse en coste total por resultado correcto (incluyendo reintentos y latencia), no solo en precio por token, especialmente con modelos de razonamiento que consumen más cómputo.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Conviene vigilar si la tendencia de caída de costes se mantiene tras los nuevos lanzamientos como GPT-6 Sol y Luna, y si aparecen métricas más robustas contra el 'benchmaxxing' que distorsionan las comparaciones de precio-rendimiento.

Recomendación Qué debería hacer una empresa

Evaluar en los próximos 6-12 meses el coste total por tarea (no solo por token) al seleccionar modelos, usando plataformas de comparación como Artificial Analysis para decisiones de compra de IA.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: The Decoder. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMmodelos de razonamientobenchmarks Epoch AIMITOpenAIArtificial Analysis benchmarkscostes de IAEpoch AIGPT-5.6MIT

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Inversión y mercado

Google confirma para el 1 de octubre el lanzamiento de su primer satélite con TPUs para centros de datos en órbita

Google lanzará el 1 de octubre el satélite MVP de Project Suncatcher, construido con Planet, que porta cuatro TPU con la potencia de un servidor de centro de…

Por qué importaEs una señal temprana de cómo las grandes tecnológicas buscan resolver la escasez energética de la IA usando energía solar orbital, aunque Google…

Impacto bajo Fiabilidad confirmado por varias fuentes Relevancia 7/10 Infobae Tecno

Oracle envía notificación de fuerza mayor sobre centro de datos Stargate en Nuevo México

Oracle envió una notificación de fuerza mayor al desarrollador de Project Jupiter, un campus de centros de datos Stargate en Nuevo México, según Bloomberg. La…

Por qué importaEl caso ilustra las tensiones energéticas y regulatorias que enfrentan los grandes proyectos de infraestructura de IA como Stargate, clave para el…

Impacto medio Fiabilidad una fuente fiable TechCrunch AI
Inversión y mercado

Google prepara el lanzamiento de un satélite experimental para centros de datos de IA en órbita

Google planea lanzar el 1 de octubre un satélite experimental llamado MVP en un Falcon 9 de SpaceX, dentro de su proyecto Suncatcher para ejecutar…

Por qué importaEs una señal de hasta dónde llegan las grandes tecnológicas para resolver las limitaciones energéticas del crecimiento de la IA, aunque el propio…

Impacto bajo Fiabilidad confirmado por varias fuentes The Decoder
Inversión y mercado

Google lanzará el 1 de octubre su primer satélite de prueba con TPUs para centros de datos orbitales

Google lanzará el 1 de octubre un satélite experimental llamado MVP, del tamaño de un frigorífico, con cuatro TPUs a bordo, dentro del proyecto Suncatcher. El…

Por qué importaEs la primera validación práctica de la idea de mover el entrenamiento e inferencia de IA fuera de la Tierra para aprovechar energía solar y evitar…

Impacto bajo Fiabilidad confirmado por varias fuentes Ars Technica AI