DeepMind lanza RT-2: modelo robótico con razonamiento visual-lingüístico
Línea temporal
-
DeepMind presenta RT-2: modelo de visión-lenguaje-acción para control robótico generalizable
Google DeepMind ha lanzado Robotic Transformer 2 (RT-2), un modelo de visión-lenguaje-acción (VLA) que integra conocimiento de datos web y robóticos para controlar robots con mayor generalización. El modelo, basado en…