AWS benchmarking de instancias GPU G7 vs G5/G6 para inferencia LLM
Enviar esta historia por correo
Línea temporal
-
AWS compara instancias G7, G6 y G5 para inferencia de LLM pequeños en SageMaker
AWS publicó un benchmark comparando instancias G5, G6, G6e y G7 de SageMaker AI para inferencia de dos modelos MoE de 30B (Qwen3-Coder-30B y NVIDIA Nemotron-3-Nano-30B). El análisis mide throughput, latencia y coste por…