Tecnología
long-context generation
Relacionadas
Historias
Noticias
DeepMind presenta Perceiver AR, arquitectura para generación con contexto de 100.000 tokens
Google DeepMind ha publicado Perceiver AR, una arquitectura autoregresiva y agnóstica de modalidad que utiliza cross-attention para procesar contextos muy…
Por qué importaLas limitaciones actuales en longitud de contexto (típicamente 2.048 tokens en Transformers) afectan la calidad de generación en tareas largas…
Impacto alto
Fiabilidad fuente primaria
Google DeepMind