Ir al contenido
IA para hoy

Lo esencial del día

AWS concentra el día: costes por usuario, destilación y agentes en producción

17 de abril de 2026, 14:00

Jornada dominada por anuncios y guías técnicas de AWS alrededor de Amazon Bedrock y la familia Nova. El hilo común es la puesta en producción de la IA con control de costes: atribución del gasto por identidad, destilación de modelos y agentes que recortan tiempos de trabajo. En el margen, señales del ecosistema de desarrollo con PyCon US y Datasette.

Bedrock ya dice quién gasta en IA y cuánto

Ilustración generada con IA sobre: AWS Bedrock introduce atribución granular de costes por usuario y modelo
Ilustración generada con IA por IA para hoy

Amazon Bedrock atribuye automáticamente el coste de inferencia al principal IAM que hace cada llamada, con desglose por identidad, modelo y tokens de entrada/salida en el Cost and Usage Report 2.0. Permite repercutir costes internamente y planificar el gasto cuando varios equipos comparten una misma cuenta.

Destilación de modelos: 95% menos coste

Fotografía de archivo que ilustra: AWS Bedrock: transferencia de inteligencia de modelo grande a pequeño reduce costes un 95%
Foto: Brett Sayles · Licencia Pexels · Pexels

Una guía de AWS muestra cómo transferir capacidades de enrutamiento de Nova Premier a Nova Micro con 10.000 ejemplos sintéticos, reduciendo un 95% el coste de inferencia y un 50% la latencia sin perder calidad de decisión. Es una vía concreta para llevar a producción tareas que hoy resultan caras con modelos grandes.

Agentes IA: de 4 horas a 10 minutos en publicación web

Fotografía de archivo que ilustra: AWS reduce tiempo de publicación web de 4 horas a 10 minutos con agentes IA
Foto: Matheus Bertelli · Licencia Pexels · Pexels

AWS y Gradial han automatizado con agentes en Bedrock el ensamblaje y publicación de páginas, pasando de hasta cuatro horas a unos diez minutos, con validación de accesibilidad y marca. Es un caso medible del valor de los agentes en flujos de trabajo de varias etapas.

Búsqueda semántica de vídeo sin pasar por texto

Ilustración generada con IA sobre: AWS Nova: búsqueda semántica de vídeo con embeddings multimodales
Ilustración generada con IA por IA para hoy

Con Nova Multimodal Embeddings, AWS demuestra búsqueda de momentos concretos en vídeo largo combinando imagen, audio, transcripción y metadatos en un mismo espacio vectorial, con código de referencia en GitHub. Interesa a medios, deportes y cualquier empresa con archivos audiovisuales extensos.

Fine-tuning de Nova con mezcla de datos

Fotografía de archivo que ilustra: AWS publica guía práctica para ajustar modelos Nova con mezcla de datos
Foto: Godfrey Atima · Licencia Pexels · Pexels

Un tutorial de AWS detalla el ajuste de modelos Nova con el SDK Nova Forge y la técnica de data mixing en cinco etapas. En el experimento citado se mantuvo la puntuación MMLU cercana a la base y se mejoró en 12 puntos F1 la clasificación de Voice of Customer, evitando la degradación típica al entrenar solo con datos propios.

El mensaje del día para las empresas es que la conversación se ha desplazado del modelo más potente al coste por tarea: medir, destilar y automatizar.

Días anteriores

Ver todo el archivo de resúmenes