Ir al contenido
IA para hoy
Herramientas y productos Lanzamiento

NVIDIA presenta Cosmos Policy para control avanzado de robots con modelos de fundación de video

Hecho Qué ha ocurrido

NVIDIA ha lanzado Cosmos Policy, una nueva política de control de robots basada en post-entrenar el modelo de fundación de video Cosmos Predict-2 para tareas de manipulación. El modelo alcanza rendimiento de última generación en los benchmarks LIBERO y RoboCasa, logrando un 12,5% más de tasa de finalización en tareas de manipulación real con bimanual usando robots ALOHA. A diferencia de los modelos de lenguaje-visión tradicionales, Cosmos Policy codifica acciones del robot, estados futuros y puntuaciones de éxito como marcos adicionales usando el mismo proceso de difusión que la generación de video.

Resumen generado mediante IA a partir de Hugging Face (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

Representa un avance significativo en control robótico mediante la reutilización de modelos de fundación de video preentrenados, reduciendo datos necesarios y mejorando la generalización. Para empresas de automatización y robótica, esto abre la posibilidad de desplegar sistemas de control más eficientes y adaptables sin necesidad de entrenar desde cero.

Quién se ve afectado
Empresas de robótica industrial y de investigación, desarrolladores de sistemas autónomos, operadores de robots de manipulación en manufactura y sectores de logística.
Qué puede cambiar
Si se adopta ampliamente, el enfoque de reutilizar modelos de fundación de video podría reducir significativamente los tiempos de desarrollo y costes de entrenamiento de políticas robóticas nuevas. El paradigma de codificar control como difusión de video podría convertirse en estándar en lugar de arquitecturas separadas de percepción y control.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Seguir la adopción en sistemas de robótica comercial y su integración en plataformas existentes; el rendimiento en tareas más complejas fuera de benchmarks académicos; si otros fabricantes adoptan este enfoque de fundación de video para control; disponibilidad de Cosmos Predict-2.5 y mejoras en eficiencia de inferencia para despliegue en tiempo real.

Recomendación Qué debería hacer una empresa

Si tu empresa desarrolla o despliega sistemas robóticos, evalúa Cosmos Policy y los modelos Cosmos disponibles en HuggingFace en los próximos 6-12 meses como potencial acelerador de ciclos de desarrollo; participa en el Cosmos Cookoff si tienes talento técnico disponible.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Hugging Face (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

modelos de fundación de videodifusióncontrol visuomotorrobótica NVIDIA automatizaciónCosmos Policymodelos de fundaciónNvidiarobótica

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Microsoft lanza Dynamics 365 Activate para migrar clientes de Salesforce con IA

Microsoft presentó Dynamics 365 Activate, una herramienta con IA en vista previa pública que analiza implementaciones de Salesforce y otros CRM/ERP para…

Por qué importaMicrosoft busca capitalizar el descontento con Agentforce de Salesforce y los problemas de márgenes derivados del gasto en IA de su competidor…

Impacto medio Fiabilidad declaración interesada The Register AI

OpenAI prueba función Writing Style para que ChatGPT imite el tono del usuario en Gmail y Slack

OpenAI está probando con un grupo reducido de usuarios una función llamada Writing Style que permite a ChatGPT leer contenido de Slack, Gmail, Google Drive y…

Por qué importaDa a ChatGPT un volumen mucho mayor de ejemplos reales de escritura que las instrucciones manuales, mejorando la personalización, pero implica…

Impacto bajo Fiabilidad declaración interesada Infobae Tecno

Sophos lanza Exploit Path Verification con modelos GPT de OpenAI para priorizar vulnerabilidades

Sophos ha anunciado Exploit Path Verification (EPV), una función que se integrará en Sophos Managed Risk para priorizar vulnerabilidades explotables. La…

Por qué importaAborda un problema real de los equipos de seguridad: la brecha entre miles de vulnerabilidades detectadas y la capacidad limitada de corregirlas…

Impacto medio Fiabilidad declaración interesada Byte TI

AWS publica guía para desplegar el modelo abierto Qwen3.8-2.4T-A95B en SageMaker HyperPod

Alibaba lanzó el 12 de agosto de 2026 Qwen3.8-2.4T-A95B, un modelo de pesos abiertos con 2,4 billones de parámetros totales (95.000 millones activados por…

Por qué importaEs la primera vez que un modelo de la clase Qwen-Max se libera en pesos abiertos, lo que da a las empresas una alternativa autoalojada frente a APIs…

Impacto medio Fiabilidad una fuente fiable AWS Machine Learning Blog