Ir al contenido
IA para hoy

Tecnología

aprendizaje por refuerzo

Relacionadas

Google DeepMind ×7agentes ×6LLM ×4visión por computadora ×3redes neuronales ×3DeepMind ×2redes neuronales profundas ×2IA científica ×1transformers ×1razonamiento ×1

Historias

Noticias

DeepMind repasa 15 años de investigación de IA en videojuegos y anuncia alianza con EVE Online

Google DeepMind ha publicado un repaso de su investigación en IA aplicada a videojuegos, desde DQN y AlphaGo hasta SIMA 2, su agente generalista basado en…

Por qué importaMuestra cómo los laboratorios de IA usan entornos de juego complejos como banco de pruebas para agentes generales que podrían transferirse a tareas…

Impacto bajo Fiabilidad una fuente fiable Google DeepMind
Modelos y avances 2 fuentes

Gemini con Deep Think logra nivel de medalla de oro en la Olimpiada Internacional de Matemáticas

Google DeepMind anunció que una versión avanzada de Gemini con Deep Think resolvió 5 de 6 problemas de la Olimpiada Internacional de Matemáticas (IMO) 2025…

Por qué importaEste hito demuestra que los modelos de IA han alcanzado razonamiento matemático de nivel élite, comparable al de los mejores matemáticos humanos del…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

Google DeepMind lanza Acme, framework para aprendizaje por refuerzo distribuido

Google DeepMind ha publicado Acme, un framework de código abierto diseñado para construir algoritmos de aprendizaje por refuerzo (RL) legibles y eficientes…

Por qué importaAcme reduce la brecha entre investigación académica y aplicación industrial en RL al facilitar la reproducibilidad y escalabilidad de algoritmos. Su…

Impacto medio Fiabilidad fuente primaria Google DeepMind

Google une DeepMind y Brain en una sola unidad para acelerar el desarrollo de IA

Google ha anunciado la fusión de DeepMind y el equipo Brain de Google Research en una única unidad llamada Google DeepMind, bajo la dirección de Demis…

Por qué importaEsta fusión consolida el poder de investigación e industrialización de IA de Google, reuniendo los laboratorios responsables de hitos como AlphaFold…

Impacto alto Fiabilidad fuente primaria Google DeepMind

AlphaDev descubre algoritmos de ordenamiento 70% más rápidos mediante aprendizaje por refuerzo

Google DeepMind ha presentado AlphaDev, un sistema de IA basado en aprendizaje por refuerzo que descubre nuevos algoritmos de ordenamiento más rápidos que los…

Por qué importaLos algoritmos de ordenamiento se ejecutan billones de veces al día en sistemas globales; mejoras incluso modestas (ahorrar una instrucción por…

Impacto alto Fiabilidad fuente primaria Google DeepMind
Investigación 3 fuentes

DeepMind: aprendizaje por refuerzo eficiente mediante composición de comportamientos

Google DeepMind ha publicado en PNAS un framework de aprendizaje por refuerzo que permite a agentes reutilizar comportamientos aprendidos previamente para…

Por qué importaLa eficiencia en el aprendizaje por refuerzo es un cuello de botella fundamental para sistemas autónomos prácticos; los enfoques convencionales…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind presenta BYOL-Explore para exploración autónoma en entornos visuales complejos

Google DeepMind ha publicado BYOL-Explore, un método de exploración impulsado por curiosidad que entrena agentes de IA usando predicción en el espacio latente…

Por qué importaEste avance demuestra cómo la exploración autónoma puede mejorar significativamente sin ingeniería de objetivos complicada, lo que es crítico para…

Impacto medio Fiabilidad fuente primaria Google DeepMind

DeepMind publica evaluación completa de AlphaZero en Science

Google DeepMind ha publicado en la revista Science la evaluación completa de AlphaZero, el sistema que en 2017 aprendió a dominar ajedrez, shogi y Go desde…

Por qué importaAlphaZero demuestra que un único algoritmo general puede dominar múltiples dominios complejos sin reglas codificadas manualmente, solo con los…

Impacto medio Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

AlphaStar derrota al campeón profesional de StarCraft II sin restricciones

Google DeepMind ha presentado AlphaStar, un sistema de IA que ha derrotado 5-0 al jugador profesional Grzegorz "MaNa" Komincz de Team Liquid en StarCraft II…

Por qué importaAlphaStar demuestra un avance significativo en capacidades de IA para problemas complejos que requieren equilibrio entre decisiones a largo y corto…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 3 fuentes

DeepMind conecta aprendizaje por refuerzo con dopamina cerebral en Nature

DeepMind publica en Nature un trabajo que vincula el algoritmo de aprendizaje por diferencia temporal (TD, temporal difference learning) con el funcionamiento…

Por qué importaEste hallazgo consolida el puente entre neurociencia e IA al demostrar que algoritmos de aprendizaje por refuerzo más sofisticados (distribucionales)…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind presenta agentes IA que imaginan y planifican acciones futuras

Google DeepMind ha publicado dos papers sobre arquitecturas de agentes basadas en 'imaginación': redes neuronales que internamente simulan consecuencias de…

Por qué importaEsta investigación avanza en el razonamiento deliberativo de agentes IA, permitiéndoles funcionar con modelos imperfectos y adaptar estrategias de…

Impacto medio Fiabilidad fuente primaria Google DeepMind
Investigación 3 fuentes

DeepMind argumenta que la neurociencia es esencial para avanzar en IA

DeepMind publica un análisis en la revista Neuron sobre el papel de la neurociencia en el progreso de la IA. El artículo, firmado por Demis Hassabis…

Por qué importaLa convergencia entre neurociencia e IA representa una oportunidad estratégica para resolver desafíos fundamentales en aprendizaje y generalización…

Impacto medio Fiabilidad una fuente fiable Google DeepMind
Investigación 2 fuentes

DeepMind y Blizzard abren StarCraft II como entorno de investigación de IA

DeepMind y Blizzard Entertainment han lanzado SC2LE, un conjunto de herramientas que permite a los investigadores usar StarCraft II como entorno de prueba para…

Por qué importaStarCraft II presenta desafíos complejos de IA más realistas que entornos previos: incluye ~100 millones de acciones posibles (vs. ~10 en Atari)…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

AlphaGo Zero aprende Go desde cero en tres días, superando versiones anteriores

Google DeepMind ha publicado en Nature el desarrollo de AlphaGo Zero, una versión mejorada de AlphaGo que aprende a jugar Go sin entrenamiento previo en…

Por qué importaAlphaGo Zero demuestra que los algoritmos de IA pueden alcanzar y superar capacidades superhúmanas partiendo de cero, sin depender de datos o…

Impacto muy alto Fiabilidad fuente primaria Google DeepMind

DeepMind publica método para analizar juegos asimétricos con múltiples agentes IA

Google DeepMind ha publicado en Scientific Reports un nuevo método basado en teoría de juegos para analizar cómo interactúan sistemas IA en situaciones…

Por qué importaA medida que múltiples sistemas IA interactúen en el mundo real—desde robots cooperativos hasta mercados automatizados—entender sus dinámicas…

Impacto bajo Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

DeepMind y Blizzard abren StarCraft II como entorno de investigación en IA

DeepMind y Blizzard Entertainment anunciaron en BlizzCon 2016 su colaboración para poner a disposición de investigadores de IA en todo el mundo el juego…

Por qué importaStarCraft II representa un desafío científico significativo para la investigación en aprendizaje por refuerzo por su complejidad: información…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

Google DeepMind presenta SIMA, agente IA generalista para entornos virtuales 3D

Google DeepMind ha presentado SIMA (Scalable Instructable Multiworld Agent), un agente de IA capaz de seguir instrucciones en lenguaje natural para realizar…

Por qué importaSIMA representa un avance significativo hacia agentes IA generales que pueden actuar en el mundo físico y digital sin requerer acceso al código…

Impacto alto Fiabilidad fuente primaria Google DeepMind