Tecnología
inferencia distribuida
Evolución en 16 semanas
El momentum semanal se estima con la misma fórmula que el momentum actual: volumen, aceleración respecto a la semana anterior, diversidad de fuentes e impacto.
Relacionadas
LLM ×3OpenAI ×1multimodal ×1Meta ×1Amazon Web Services ×1AWS ×1Amazon ×1GPU ×1Salesforce ×1Amazon AWS ×1
Historias
Noticias
AWS mejora disponibilidad de modelos en SageMaker con distribucion multi-zona
AWS ha añadido capacidades de control de ubicación (SchedulingConfig) a los Componentes de Inferencia de SageMaker, permitiendo distribuir copias de modelos de…
Por qué importaLas empresas que despliegan modelos de IA en producción necesitan garantizar disponibilidad ante fallos de instancias y zonas completas; esta mejora…
AWS despliega modelos GPT-5.6 de OpenAI en India con residencia de datos garantizada
Amazon Bedrock ahora soporta los modelos GPT-5.6 Terra y Luna de OpenAI en India con inferencia geográfica entre regiones (Mumbai y Hyderabad). Los modelos…
Por qué importaLas empresas en India, especialmente en finanzas, sanidad y sector público, pueden ahora usar modelos de frontera de OpenAI sin riesgo de…
AWS optimiza inferencia de LLMs con separación de prefill y decode en SageMaker HyperPod
AWS publica cómo implementar Disaggregated Prefill and Decode (DPD) con vLLM en SageMaker HyperPod, una técnica que separa el procesamiento de prompts largos…
Por qué importaLas empresas que despliegan LLMs a escala enfrentan cuellos de botella cuando prompts largos bloquean la generación de tokens en otros usuarios. DPD…
AWS Bedrock añade perfiles de inferencia entre regiones con protección GDPR
AWS ha expandido Amazon Bedrock con capacidades de inferencia entre regiones (CRIS: cross-Region Inference) que dirigen automáticamente solicitudes a través de…
Por qué importaLas empresas europeas que usan IA generativa en AWS ahora pueden balancear disponibilidad de modelos y capacidad global con cumplimiento normativo…



