DeepMind presenta RT-2: modelo de visión-lenguaje-acción para control robótico generalizable
Google DeepMind ha lanzado Robotic Transformer 2 (RT-2), un modelo de visión-lenguaje-acción (VLA) que integra conocimiento de datos web y robóticos para…
Por qué importaRT-2 representa un salto cualitativo en la capacidad de robots para generalizar y razonar sobre instrucciones nuevas sin haber visto esos objetos o…
Impacto alto
Fiabilidad fuente primaria
Google DeepMind