Modelos de IA controlan un Toyota Corolla en circuito cerrado: solo uno completa el recorrido

Hecho Qué ha ocurrido
El grupo DrivingBench probó a GPT-6 Astra, Claude Fable 5.1, Grok 4.6 y GPT-5.6 Sol para conducir un Toyota Corolla real en un circuito cerrado de 130 metros, a velocidad reducida y con una persona lista para frenar. Solo GPT-6 Astra completó el recorrido; GPT-5.6 Sol avanzó alrededor del 6% del trazado y Grok 4.6 alrededor del 11%. Algunos modelos se negaron ocasionalmente a conducir al detectar un vehículo físico.
Resumen generado mediante IA a partir de El Confidencial Tecnología. Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Muestra que los modelos de propósito general pueden interpretar imágenes y ejecutar órdenes de conducción, pero con una fiabilidad muy irregular. Para una empresa, la lección es que la autonomía física aún está lejos de ser predecible.
- Quién se ve afectado
- Fabricantes de automoción, empresas de movilidad y equipos que planteen agentes de IA sobre sistemas físicos.
- Qué puede cambiar
- Por ahora no cambia ninguna práctica operativa. El resultado sugiere que la conducción mediante modelos generalistas es una línea de investigación y no un producto cercano.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Si DrivingBench repite los ensayos con más intentos y circuitos distintos, y si otros laboratorios publican resultados comparables con evaluaciones de seguridad independientes.
Enviar esta noticia por correo
Fuente original: El Confidencial Tecnología. La referencia es siempre el artículo original.
Ver fuente original ↗LLMmultimodalagentes DrivingBenchOpenAIAnthropicxAIToyota Claude Fable 5.1conducción autónomaDrivingBenchGPT-6 AstraGrok 4.6
Tu opinión
0 comentarios
Relacionadas
Un estudio de Harvard halla que los agentes de código generan más código, pero no más software
Un estudio de los investigadores de Harvard Fiona Chen y James Stratton, basado en datos agregados de la plataforma Jellyfish, analiza más de 700 empresas de…
Por qué importaLas ganancias de productividad de los asistentes de código no se trasladan automáticamente al producto final si la revisión y los procesos…
Matemáticos necesitarán años para entender la avalancha de resultados de OpenAI
OpenAI publicó de forma repentina una gran cantidad de resultados matemáticos. Más de treinta y tres matemáticos consultados por The Verge describen la…
Por qué importaSi los resultados se confirman, la IA podría estar aportando avances en matemáticas a una escala nueva, lo que afecta a cómo se evalúan y validan los…
Un modelo de IA de OpenAI acierta más que los médicos en el triage de una guardia
Un estudio publicado en la revista Science comparó el modelo o1 de OpenAI con dos médicos en 79 casos reales de la guardia del Beth Israel Deaconess Medical…
Por qué importaMuestra que los modelos de razonamiento pueden competir con profesionales en decisiones con información incompleta, un escenario frecuente en la…
Claude Science de Anthropic elabora el primer mapa ultravioleta completo del cielo
El astrofísico Brice Ménard, de Johns Hopkins University, usó Claude Science para cartografiar todo el cielo en luz ultravioleta por primera vez. Agentes de IA…
Por qué importaMuestra cómo los agentes de IA pueden asumir tareas de preparación y calibración de datos que consumen mucho tiempo en investigación. Para cualquier…



