Ir al contenido
IA para hoy
Investigación Investigación

Pathway desarrolla BDH, arquitectura post-transformer, en Amazon SageMaker HyperPod

Pathway desarrolla BDH, arquitectura post-transformer, en Amazon SageMaker HyperPod
Imagen: AWS Machine Learning Blog

Hecho Qué ha ocurrido

Pathway ha desarrollado BDH (Baby Dragon Hatchling), una arquitectura post-transformer inspirada en el cerebro que razona en espacio latente sin generar tokens de cadena de pensamiento, escalando su entrenamiento en Amazon SageMaker HyperPod. Su variante BDH-CQ, con 150M de parámetros, alcanzó un nuevo récord de eficiencia en coste en el benchmark ARC-AGI-1. El modelo activa solo un 5% de sus neuronas por inferencia y mapea sus estados a conexiones sinápticas interpretables, según Pathway y AWS.

Resumen generado mediante IA a partir de AWS Machine Learning Blog (original en inglés). Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Si se confirma su eficiencia y capacidad de generalización, podría reducir drásticamente los costes de inferencia en tareas de razonamiento respecto a los LLM basados en transformers, además de ofrecer más interpretabilidad para sectores regulados.

Quién se ve afectado
Empresas de infraestructura de IA, laboratorios de investigación y sectores regulados que necesiten trazabilidad en el razonamiento del modelo.
Qué puede cambiar
Se abre la posibilidad de arquitecturas alternativas a los transformers que aprenden y razonan sin reentrenamiento completo ni ventanas de contexto fijas, reduciendo el coste computacional por tarea de razonamiento.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Conviene vigilar publicaciones independientes de benchmarks sobre BDH, su adopción por otros clientes de SageMaker HyperPod y si Pathway libera pesos o papers técnicos que permitan verificación externa.

Recomendación Qué debería hacer una empresa

Los equipos de I+D en IA deberían seguir la evolución de BDH y sus benchmarks en los próximos 6-12 meses antes de evaluar pilotos, dado que aún es una arquitectura emergente sin validación independiente amplia.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram Correo

Fuente original: AWS Machine Learning Blog (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

arquitecturas post-transformerrazonamiento en espacio latenteaprendizaje Hebbianoinfraestructura de entrenamiento ARC-AGIBDHPathwaypost-transformerSageMaker HyperPod

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación 5 fuentes

OpenAI afirma que un modelo no público resolvió el problema de Navier-Stokes

OpenAI aseguró que un modelo aún no lanzado, más capaz que GPT-6 Astra, resolvió con ayuda de hasta 10.000 agentes de IA trabajando 88 horas uno de los…

Por qué importaSi se confirma de forma independiente, supondría un salto relevante en la capacidad de los sistemas de IA para investigación matemática avanzada y…

Impacto bajo Fiabilidad confirmado por varias fuentes Relevancia 9/10 Expansión Economía Digital
Investigación 5 fuentes

Controversia por el anuncio de OpenAI sobre resolución del problema Navier-Stokes con IA

OpenAI afirmó en una entrada de blog haber encontrado una solución a un aspecto del problema Navier-Stokes, uno de los siete Problemas del Milenio sin resolver…

Por qué importaSi se confirma, sería un hito histórico para la IA aplicada a matemáticas avanzadas y ciencia fundamental, con implicaciones para la credibilidad de…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 8/10 The Verge AI
Investigación 5 fuentes

OpenAI afirma resolver la ecuación de Navier-Stokes con IA, pero enfrenta acusaciones de mala praxis

OpenAI anunció que un modelo de IA resolvió una demostración relacionada con la ecuación de Navier-Stokes, uno de los Problemas del Milenio, tras dedicar más…

Por qué importaEl episodio evidencia tensiones crecientes entre laboratorios de IA y la comunidad académica sobre atribución de méritos cuando la IA participa en…

Impacto bajo Fiabilidad confirmado por varias fuentes Relevancia 8/10 Wired en Español
Investigación

Google DeepMind lanza AlphaGenome Atlas con predicciones sobre 9.000 millones de variantes de ADN

Google DeepMind ha publicado AlphaGenome Atlas, un recurso que reúne predicciones sobre efectos moleculares de más de 9.000 millones de variantes de un solo…

Por qué importaEste tipo de mapas predictivos permite priorizar qué variantes genéticas merece la pena investigar experimentalmente, acelerando potencialmente la…

Impacto medio Fiabilidad una fuente fiable Relevancia 8/10 Xataka