NVIDIA MPS reduce costes de inferencia ASR en 75%
Enviar esta historia por correo
Línea temporal
-
AWS y NVIDIA reducen costes de inferencia de reconocimiento de voz en un 75%
AWS, NVIDIA y Heidi Health han publicado un estudio técnico demostrando cómo usar NVIDIA CUDA Multi-Process Service (MPS) en Amazon EC2 reduce la infraestructura GPU necesaria para servir modelos de reconocimiento…