AWS publica benchmark que mide coste por respuesta correcta, no solo precio por token, en modelos OpenAI en Bedrock
AWS publicó un harness de benchmarking de código abierto que compara modelos OpenAI (gpt-5.6-luna, gpt-5.6-terra, gpt-5.6-sol) disponibles en Amazon Bedrock…
Por qué importaMuestra que comparar modelos solo por precio por token puede llevar a decisiones equivocadas, ya que el número de reintentos, turnos de conversación…
Impacto medio
Fiabilidad una fuente fiable
AWS Machine Learning Blog
