AWS lanza caché inteligente LMCache para inferencia de contextos largos
Enviar esta historia por correo
Línea temporal
-
AWS mejora el contenedor LMI con caché inteligente para inferencia de contextos extensos
AWS ha publicado actualizaciones al contenedor Large Model Inference (LMI) con soporte para LMCache, una solución de caché de pares clave-valor que reutiliza cálculos precompilados de fragmentos de texto repetidos. En…