Ir al contenido
IA para hoy
Cerrada 1 noticias · 1 fuentesdel 20 feb al 20 feb

Taalas optimiza inferencia de Llama con hardware dedicado a 17k tokens/s

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta historia por correo

Se envía el resumen de la historia, qué ha cambiado y su línea temporal. La dirección se usa solo para ese envío y no se guarda.

Línea temporal

  1. Simon WillisonFiabilidad una fuente fiable

    Taalas ejecuta Llama 3.1 8B a 17.000 tokens por segundo con hardware personalizado

    Taalas, startup de hardware canadiense, anunció su primer producto: una implementación de hardware personalizado de Llama 3.1 8B capaz de ejecutarse a 17.000 tokens por segundo. El modelo usa cuantización agresiva…

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.