Tecnología
prompt caching
Evolución en 16 semanas
El momentum semanal se estima con la misma fórmula que el momentum actual: volumen, aceleración respecto a la semana anterior, diversidad de fuentes e impacto.
Relacionadas
LLM ×3agentes ×2OpenAI ×2Amazon Web Services ×2Anthropic ×1multimodal ×1RAG ×1AWS ×1API Responses ×1
Historias
Noticias
OpenAI GPT-5.6 disponible en Amazon Bedrock desde Australia con enrutamiento global
AWS ha habilitado el acceso a los modelos OpenAI GPT-5.6 Sol, Terra y Luna en Amazon Bedrock desde las regiones de Asia Pacific (Sydney) y Asia Pacific…
Por qué importaAmplía la disponibilidad de modelos de último nivel para equipos en Australia y reduce la latencia al distribuir la capacidad sin que las…
AWS muestra cómo reducir costos de RAG con compresión de contexto inteligente
AWS ha publicado un patrón de arquitectura para sistemas RAG en Amazon Bedrock que utiliza un modelo más pequeño (Claude Haiku) para filtrar fragmentos de…
Por qué importaLos costos de tokens de entrada son una parte significativa del gasto en sistemas RAG a escala. Esta técnica permite que las empresas reduzcan costos…
OpenAI GPT-5.6 ya disponible en Amazon Bedrock con caché explícito de prompts
OpenAI ha lanzado sus modelos GPT-5.6 (Sol, Terra y Luna) como disponibilidad general en Amazon Bedrock, acompañados de caché explícito de prompts que permite…
Por qué importaPara empresas con flujos de trabajo extensivos que reutilizan instrucciones, definiciones de herramientas y documentos de referencia (especialmente…


