Ingenieros prueban GPT-6 Astra, Claude y Grok al volante de un auto real; solo uno logra conducir bien

Hecho Qué ha ocurrido
Tres ingenieros de la startup Axiom conectaron modelos de lenguaje (GPT-6 Astra de OpenAI, Claude Fable 5.1 de Anthropic y Grok de SpaceXAI) al sistema de dirección de un Toyota Corolla mediante cámaras y un servidor, sin entrenamiento previo específico para conducir. En su prueba informal, Astra condujo hasta una ventanilla de drive-thru de forma lenta pero segura. En un benchmark propio llamado DrivingBench sobre un estacionamiento, solo Astra completó el recorrido, Claude llegó al 45% y Grok al 11%.
Resumen generado mediante IA a partir de Wired en Español. Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Sugiere que los modelos de lenguaje multimodales están desarrollando capacidades emergentes de razonamiento espacial y físico no entrenadas explícitamente, lo que podría ampliar su aplicación más allá de tareas digitales hacia robótica y control de sistemas físicos.
- Quién se ve afectado
- Empresas de robótica, automoción, startups de IA física y laboratorios que desarrollan modelos multimodales.
- Qué puede cambiar
- Si se confirma esta capacidad emergente, los laboratorios podrían explorar aplicaciones de razonamiento físico sin necesidad de entrenamiento específico para cada tarea, acelerando el desarrollo de robótica general.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si OpenAI, Anthropic o xAI publican benchmarks oficiales de razonamiento físico, y si surgen más pruebas independientes tipo DrivingBench o Humanity's Sixth Sense que midan estas capacidades de forma estandarizada.
Enviar esta noticia por correo
Fuente original: Wired en Español. La referencia es siempre el artículo original.
Ver fuente original ↗multimodalroboticarazonamiento espacial OpenAIAnthropicSpaceXAIAxiomScale AI Claudeconducción autónomaGPT-6 AstraGrokrazonamiento físico
Tu opinión
0 comentarios
Relacionadas
Físicos proponen una fórmula para predecir cuándo la IA da respuestas erróneas o dañinas
Un estudio firmado por dos físicos propone un marco para entender y predecir cuándo las respuestas de los modelos de IA se desvían hacia resultados…
Por qué importaSi se confirma, ofrecería una herramienta para anticipar comportamientos erráticos de modelos de IA antes de desplegarlos en producción, un problema…
La comunidad matemática se divide ante los resultados de OpenAI en problemas de investigación
OpenAI ha publicado varios resultados matemáticos generados por modelos internos, incluyendo una supuesta solución al problema de Navier-Stokes y un avance…
Por qué importaMarca un punto de inflexión en el uso de IA en investigación científica de alto nivel, generando tensión entre innovación tecnológica y normas…
MIT Technology Review analiza por qué los robots humanoides con IA tardarán años en ser útiles
El artículo repasa el estado de la robótica humanoide impulsada por IA, citando a Elon Musk (Optimus de Tesla), Jensen Huang (Nvidia) y Marc Andreessen, frente…
Por qué importaLa narrativa de 'robots humanoides inminentes' influye en inversión y expectativas de mercado, pero el desfase entre el discurso corporativo y la…
Google, Meta y Biohub invierten 1.800 millones en IA para simular células biológicas
Google, Meta y el Chan Zuckerberg Biohub anunciaron una inversión conjunta superior a 1.800 millones de dólares para desarrollar un modelo de IA capaz de…
Por qué importaEs una apuesta de gran escala por modelar la biología celular completa, con aplicaciones potenciales en oncología y envejecimiento que podrían…



