Tecnología
aprendizaje por refuerzo
Relacionadas
Google DeepMind ×7agentes ×6LLM ×4visión por computadora ×3redes neuronales ×3DeepMind ×2redes neuronales profundas ×2IA científica ×1transformers ×1razonamiento ×1
Historias
DeepMind anuncia SIMA 2 y alianza de investigación con EVE Online
Gemini Deep Think avanza de la Olimpiada de Matemáticas a investigación científica
Google DeepMind lanza Acme: framework para RL distribuido
AlphaDev optimiza algoritmos fundamentales con aprendizaje por refuerzo
DeepMind: agentes IA cooperativos en juegos multijugador
DeepMind publica evaluación completa de AlphaZero en Science
BYOL-Explore: exploración con predicción autoasistida
DeepMind presenta avances en generalización y eficiencia en ICLR 2023
Noticias
DeepMind repasa 15 años de investigación de IA en videojuegos y anuncia alianza con EVE Online
Google DeepMind ha publicado un repaso de su investigación en IA aplicada a videojuegos, desde DQN y AlphaGo hasta SIMA 2, su agente generalista basado en…
Por qué importaMuestra cómo los laboratorios de IA usan entornos de juego complejos como banco de pruebas para agentes generales que podrían transferirse a tareas…
Gemini con Deep Think logra nivel de medalla de oro en la Olimpiada Internacional de Matemáticas
Google DeepMind anunció que una versión avanzada de Gemini con Deep Think resolvió 5 de 6 problemas de la Olimpiada Internacional de Matemáticas (IMO) 2025…
Por qué importaEste hito demuestra que los modelos de IA han alcanzado razonamiento matemático de nivel élite, comparable al de los mejores matemáticos humanos del…
Google DeepMind lanza Acme, framework para aprendizaje por refuerzo distribuido
Google DeepMind ha publicado Acme, un framework de código abierto diseñado para construir algoritmos de aprendizaje por refuerzo (RL) legibles y eficientes…
Por qué importaAcme reduce la brecha entre investigación académica y aplicación industrial en RL al facilitar la reproducibilidad y escalabilidad de algoritmos. Su…
DeepMind logra rendimiento a nivel humano en agentes cooperativos multiagente con Quake III
Google DeepMind publica en Science un estudio sobre agentes de aprendizaje por refuerzo que alcanzan rendimiento a nivel humano en Capture the Flag de Quake…
Por qué importaEste avance demuestra que los sistemas de IA pueden resolver problemas complejos de aprendizaje multiagente con cooperación y competencia…
DeepMind publica métodos de negociación y cooperación para agentes IA en Diplomacy
Google DeepMind publica un artículo en Nature Communications sobre cómo los agentes de IA pueden comunicarse y negociar para cooperar mejor en el juego de mesa…
Por qué importaEl trabajo aborda un problema fundamental para sistemas de IA colaborativos y multiagente: cómo garantizar que los agentes se comuniquen…
Google une DeepMind y Brain en una sola unidad para acelerar el desarrollo de IA
Google ha anunciado la fusión de DeepMind y el equipo Brain de Google Research en una única unidad llamada Google DeepMind, bajo la dirección de Demis…
Por qué importaEsta fusión consolida el poder de investigación e industrialización de IA de Google, reuniendo los laboratorios responsables de hitos como AlphaFold…
DeepMind presenta 23 papers en ICLR 2023 sobre generalización y aceleración científica
DeepMind ha participado como patrocinador Diamond en la 11ª Conferencia Internacional de Representaciones de Aprendizaje (ICLR) celebrada en Kigali, Ruanda…
Por qué importaLos avances presentados abordan retos críticos para la IA empresarial: generalización entre tareas, eficiencia computacional, interpretabilidad y…
AlphaDev descubre algoritmos de ordenamiento 70% más rápidos mediante aprendizaje por refuerzo
Google DeepMind ha presentado AlphaDev, un sistema de IA basado en aprendizaje por refuerzo que descubre nuevos algoritmos de ordenamiento más rápidos que los…
Por qué importaLos algoritmos de ordenamiento se ejecutan billones de veces al día en sistemas globales; mejoras incluso modestas (ahorrar una instrucción por…
DeepMind: aprendizaje por refuerzo eficiente mediante composición de comportamientos
Google DeepMind ha publicado en PNAS un framework de aprendizaje por refuerzo que permite a agentes reutilizar comportamientos aprendidos previamente para…
Por qué importaLa eficiencia en el aprendizaje por refuerzo es un cuello de botella fundamental para sistemas autónomos prácticos; los enfoques convencionales…
DeepMind presenta BYOL-Explore para exploración autónoma en entornos visuales complejos
Google DeepMind ha publicado BYOL-Explore, un método de exploración impulsado por curiosidad que entrena agentes de IA usando predicción en el espacio latente…
Por qué importaEste avance demuestra cómo la exploración autónoma puede mejorar significativamente sin ingeniería de objetivos complicada, lo que es crítico para…
DeepMind publica evaluación completa de AlphaZero en Science
Google DeepMind ha publicado en la revista Science la evaluación completa de AlphaZero, el sistema que en 2017 aprendió a dominar ajedrez, shogi y Go desde…
Por qué importaAlphaZero demuestra que un único algoritmo general puede dominar múltiples dominios complejos sin reglas codificadas manualmente, solo con los…
AlphaStar derrota al campeón profesional de StarCraft II sin restricciones
Google DeepMind ha presentado AlphaStar, un sistema de IA que ha derrotado 5-0 al jugador profesional Grzegorz "MaNa" Komincz de Team Liquid en StarCraft II…
Por qué importaAlphaStar demuestra un avance significativo en capacidades de IA para problemas complejos que requieren equilibrio entre decisiones a largo y corto…
DeepMind conecta aprendizaje por refuerzo con dopamina cerebral en Nature
DeepMind publica en Nature un trabajo que vincula el algoritmo de aprendizaje por diferencia temporal (TD, temporal difference learning) con el funcionamiento…
Por qué importaEste hallazgo consolida el puente entre neurociencia e IA al demostrar que algoritmos de aprendizaje por refuerzo más sofisticados (distribucionales)…
DeepMind abre su primer laboratorio internacional de investigación en Canadá
Google DeepMind ha anunciado la apertura de su primer laboratorio de investigación fuera del Reino Unido en Edmonton, Alberta, en colaboración con la…
Por qué importaEste movimiento refleja la consolidación de DeepMind como actor global en investigación de IA y subraya la importancia de Canadá, especialmente…
DeepMind presenta agentes IA que imaginan y planifican acciones futuras
Google DeepMind ha publicado dos papers sobre arquitecturas de agentes basadas en 'imaginación': redes neuronales que internamente simulan consecuencias de…
Por qué importaEsta investigación avanza en el razonamiento deliberativo de agentes IA, permitiéndoles funcionar con modelos imperfectos y adaptar estrategias de…
DeepMind argumenta que la neurociencia es esencial para avanzar en IA
DeepMind publica un análisis en la revista Neuron sobre el papel de la neurociencia en el progreso de la IA. El artículo, firmado por Demis Hassabis…
Por qué importaLa convergencia entre neurociencia e IA representa una oportunidad estratégica para resolver desafíos fundamentales en aprendizaje y generalización…
DeepMind y Blizzard abren StarCraft II como entorno de investigación de IA
DeepMind y Blizzard Entertainment han lanzado SC2LE, un conjunto de herramientas que permite a los investigadores usar StarCraft II como entorno de prueba para…
Por qué importaStarCraft II presenta desafíos complejos de IA más realistas que entornos previos: incluye ~100 millones de acciones posibles (vs. ~10 en Atari)…
AlphaGo Zero aprende Go desde cero en tres días, superando versiones anteriores
Google DeepMind ha publicado en Nature el desarrollo de AlphaGo Zero, una versión mejorada de AlphaGo que aprende a jugar Go sin entrenamiento previo en…
Por qué importaAlphaGo Zero demuestra que los algoritmos de IA pueden alcanzar y superar capacidades superhúmanas partiendo de cero, sin depender de datos o…
DeepMind publica método para analizar juegos asimétricos con múltiples agentes IA
Google DeepMind ha publicado en Scientific Reports un nuevo método basado en teoría de juegos para analizar cómo interactúan sistemas IA en situaciones…
Por qué importaA medida que múltiples sistemas IA interactúen en el mundo real—desde robots cooperativos hasta mercados automatizados—entender sus dinámicas…
DeepMind introduce redes neuronales con memoria diferenciable para razonamiento estructurado
Google DeepMind publica en Nature un estudio sobre Differentiable Neural Computers (DNCs), redes neuronales aumentadas con memoria que pueden aprender a usar…
Por qué importaDNCs combinan capacidades de aprendizaje neural con estructuras computacionales explícitas, permitiendo razonamiento deliberado sobre datos…
DeepMind y Blizzard abren StarCraft II como entorno de investigación en IA
DeepMind y Blizzard Entertainment anunciaron en BlizzCon 2016 su colaboración para poner a disposición de investigadores de IA en todo el mundo el juego…
Por qué importaStarCraft II representa un desafío científico significativo para la investigación en aprendizaje por refuerzo por su complejidad: información…
Google DeepMind presenta SIMA, agente IA generalista para entornos virtuales 3D
Google DeepMind ha presentado SIMA (Scalable Instructable Multiworld Agent), un agente de IA capaz de seguir instrucciones en lenguaje natural para realizar…
Por qué importaSIMA representa un avance significativo hacia agentes IA generales que pueden actuar en el mundo físico y digital sin requerer acceso al código…