IA Ataraxos vence de forma decisiva al mejor jugador de Stratego por menos de 8.000 dólares de entrenamiento

Hecho Qué ha ocurrido
Investigadores de Carnegie Mellon, NYU, Stanford y MIT presentaron en Nature a Ataraxos, un sistema de IA que venció al jugador neerlandés Pim Niemeijer, considerado el mejor de la historia de Stratego, con 15 victorias, 1 derrota y 4 empates en 20 partidas. El entrenamiento costó menos de 8.000 dólares usando 16 GPU Nvidia H100 durante una semana, frente a los 3-4,5 millones de dólares estimados que gastó DeepMind en 2023 con su sistema DeepNash, que no logró superar a los mejores humanos. Ataraxos aprende solo por autojuego, usa regularización para variar su estilo y una red de creencias que infiere las piezas ocultas del rival.
Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
Demuestra que problemas con enorme información oculta, antes resistentes al aprendizaje por refuerzo salvo con presupuestos multimillonarios, ahora son abordables con recursos académicos modestos gracias a mejoras algorítmicas y eficiencia de muestreo.
- Quién se ve afectado
- Investigadores en IA, empresas de simulación estratégica y sectores con decisiones bajo información incompleta como finanzas, negociación y defensa.
- Qué puede cambiar
- Se abre la puerta a aplicar técnicas similares a problemas reales con información oculta (mercados financieros, negociaciones, conflictos) si se pueden construir simuladores rápidos y precisos, reduciendo drásticamente el coste computacional necesario.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Si se extienden estas técnicas de regularización y búsqueda eficiente a dominios comerciales reales, y si otros equipos replican la eficiencia de cómputo reportada con el código ya publicado de Ataraxos.
Enviar esta noticia por correo
Fuente original: The Decoder. La referencia es siempre el artículo original.
Ver fuente original ↗aprendizaje por refuerzoautojuegobúsquedaredes neuronales Carnegie Mellon UniversityNYUStanford UniversityMITGoogle DeepMind aprendizaje por refuerzoAtaraxosDeepMindjuegosStratego
Forma parte de la historia IA Ataraxos vence al mejor jugador humano de Stratego con bajo coste (3 noticias, estado: evolución rápida).
Tu opinión
0 comentarios
Relacionadas
IA Ataraxos vence al mejor jugador humano de Stratego con entrenamiento de solo 8.000 dólares
Investigadores de MIT, Carnegie Mellon, Stanford y NYU crearon Ataraxos, un sistema de IA que derrotó al campeón neerlandés Pim Niemeijer 15-1 con 4 empates en…
Por qué importaDemuestra que es posible alcanzar desempeño sobrehumano en entornos de información oculta (muy relevantes para negociación, ciberseguridad o…
IA bautizada Ataraxos vence al mejor jugador humano de Stratego por primera vez
Investigadores de Carnegie Mellon, MIT, NYU y Stanford desarrollaron una IA llamada Ataraxos que venció a Pim Niemeijer, considerado el mejor jugador de…
Por qué importaStratego es un juego de información oculta a largo plazo, y resolverlo con un presupuesto modesto muestra que técnicas eficientes pueden superar…
Científicos israelíes crean IA que reconstruye imágenes vistas a partir de escáneres cerebrales
Investigadores del Instituto Weizmann, liderados por Michal Irani, desarrollaron un decodificador cerebral que reconstruye imágenes observadas a partir de…
Por qué importaReduce drásticamente el coste y tiempo necesarios para este tipo de investigación neurocientífica (cada hora de fMRI cuesta entre 600 y 1.000…
Google envía al espacio su primer chip TPU para probar centros de datos orbitales
Google lanzó al espacio en un cohete de SpaceX un satélite de Planet Labs con un chip TPU, dentro del Proyecto Suncatcher. El chip operará en ráfagas de 15…
Por qué importaEs la primera validación real de hardware de IA avanzado en órbita, un paso hacia infraestructura de cómputo espacial a gran escala que dependerá…



