Ir al contenido
IA para hoy
Investigación Investigación 3/5 · Una fuente fiable

Ingenieros prueban GPT-6 Astra, Claude y Grok al volante de un auto real; solo uno logra conducir bien

Ingenieros prueban GPT-6 Astra, Claude y Grok al volante de un auto real; solo uno logra conducir bien
Foto: Erik Mclean · Licencia Pexels · Pexels

Hecho Qué ha ocurrido

Tres ingenieros de la startup Axiom conectaron modelos de lenguaje (GPT-6 Astra de OpenAI, Claude Fable 5.1 de Anthropic y Grok de SpaceXAI) al sistema de dirección de un Toyota Corolla mediante cámaras y un servidor, sin entrenamiento previo específico para conducir. En su prueba informal, Astra condujo hasta una ventanilla de drive-thru de forma lenta pero segura. En un benchmark propio llamado DrivingBench sobre un estacionamiento, solo Astra completó el recorrido, Claude llegó al 45% y Grok al 11%.

Resumen generado mediante IA a partir de Wired en Español. Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Sugiere que los modelos de lenguaje multimodales están desarrollando capacidades emergentes de razonamiento espacial y físico no entrenadas explícitamente, lo que podría ampliar su aplicación más allá de tareas digitales hacia robótica y control de sistemas físicos.

Quién se ve afectado
Empresas de robótica, automoción, startups de IA física y laboratorios que desarrollan modelos multimodales.
Qué puede cambiar
Si se confirma esta capacidad emergente, los laboratorios podrían explorar aplicaciones de razonamiento físico sin necesidad de entrenamiento específico para cada tarea, acelerando el desarrollo de robótica general.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar si OpenAI, Anthropic o xAI publican benchmarks oficiales de razonamiento físico, y si surgen más pruebas independientes tipo DrivingBench o Humanity's Sixth Sense que midan estas capacidades de forma estandarizada.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Wired en Español. La referencia es siempre el artículo original.

Ver fuente original ↗

multimodalroboticarazonamiento espacial OpenAIAnthropicSpaceXAIAxiomScale AI Claudeconducción autónomaGPT-6 AstraGrokrazonamiento físico

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

Físicos proponen una fórmula para predecir cuándo la IA da respuestas erróneas o dañinas

Un estudio firmado por dos físicos propone un marco para entender y predecir cuándo las respuestas de los modelos de IA se desvían hacia resultados…

Por qué importaSi se confirma, ofrecería una herramienta para anticipar comportamientos erráticos de modelos de IA antes de desplegarlos en producción, un problema…

Impacto bajo Fiabilidad una fuente fiable El País Tecnología
Investigación

La comunidad matemática se divide ante los resultados de OpenAI en problemas de investigación

OpenAI ha publicado varios resultados matemáticos generados por modelos internos, incluyendo una supuesta solución al problema de Navier-Stokes y un avance…

Por qué importaMarca un punto de inflexión en el uso de IA en investigación científica de alto nivel, generando tensión entre innovación tecnológica y normas…

Impacto bajo Fiabilidad una fuente fiable Relevancia 7/10 Xataka
Investigación

MIT Technology Review analiza por qué los robots humanoides con IA tardarán años en ser útiles

El artículo repasa el estado de la robótica humanoide impulsada por IA, citando a Elon Musk (Optimus de Tesla), Jensen Huang (Nvidia) y Marc Andreessen, frente…

Por qué importaLa narrativa de 'robots humanoides inminentes' influye en inversión y expectativas de mercado, pero el desfase entre el discurso corporativo y la…

Impacto medio Fiabilidad una fuente fiable Relevancia 7/10 MIT Technology Review
Investigación

Google, Meta y Biohub invierten 1.800 millones en IA para simular células biológicas

Google, Meta y el Chan Zuckerberg Biohub anunciaron una inversión conjunta superior a 1.800 millones de dólares para desarrollar un modelo de IA capaz de…

Por qué importaEs una apuesta de gran escala por modelar la biología celular completa, con aplicaciones potenciales en oncología y envejecimiento que podrían…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 8/10 WWWhat's new