AWS SageMaker: planes de entrenamiento flexible para inferencia con GPU reservada
Resumen En qué punto está
AWS ha extendido SageMaker AI Training Plans para permitir reservar capacidad de GPU con precios transparentes en endpoints de inferencia, útil para evaluaciones de modelos, pruebas A/B y picos de tráfico predecibles. Junto a esto, mejoró componentes de inferencia con disponibilidad Multi-AZ, escalado paralelo de copias de modelo y cachés NVMe. En paralelo, AWS también añadió mejoras de observabilidad y personalización serverless en SageMaker AI para modelos generativos, disponibles en cuatro regiones con precio por token.
Resumen generado mediante IA a partir de las 2 noticias de la historia. Última actualización: hace 11 h.
Enviar esta historia por correo
Línea temporal
-
AWS SageMaker añade planes de entrenamiento flexible para inferencia con GPUs reservadas
AWS ha extendido su servicio SageMaker AI Training Plans para soportar endpoints de inferencia, permitiendo reservar capacidad de GPU por periodos específicos con precios transparentes. La plataforma ahora permite a los…
-
AWS SageMaker mejora observabilidad y personalización de modelos generativos en 2025
AWS ha lanzado mejoras en SageMaker AI para 2025 enfocadas en observabilidad, personalización y alojamiento de modelos generativos. Las principales novedades incluyen métricas mejoradas a nivel de instancia y contenedor…