Tecnología
vision
Relacionadas
multimodal ×3Google DeepMind ×3agentes ×1robótica ×1Gemini ×1aprendizaje por refuerzo ×1benchmark ×1
Historias
Noticias
RoboCat: agente automejorable de DeepMind que aprende tareas robóticas con pocos datos
Google DeepMind presenta RoboCat, un agente de IA basado en el modelo multimodal Gato que aprende a realizar múltiples tareas en diferentes brazos robóticos…
Por qué importaReduce significativamente la barrera de datos etiquetados en robótica, que es el principal cuello de botella en el desarrollo de robots multiusos. La…
DeepMind presenta Perception Test, benchmark multimodal para evaluar percepción en IA
Google DeepMind ha lanzado el Perception Test, un benchmark basado en videos reales del mundo para evaluar las capacidades perceptivas de modelos de IA…
Por qué importaLos benchmarks son instrumentos clave para definir objetivos de investigación y medir progreso en IA. El Perception Test aborda una brecha…
Google DeepMind transforma el puntero del ratón en asistente de IA contextual
Google DeepMind ha desarrollado un puntero del ratón impulsado por inteligencia artificial que comprende el contexto visual y semántico de lo que señala…
Por qué importaRepresenta un cambio fundamental en cómo interactuamos con la IA: del usuario adaptándose a la máquina (escribir prompts detallados) a la máquina…