Ir al contenido
IA para hoy
Investigación Investigación 3/5 · Una fuente fiable

Modelos de IA controlan un Toyota Corolla en circuito cerrado: solo uno completa el recorrido

Modelos de IA controlan un Toyota Corolla en circuito cerrado: solo uno completa el recorrido
Foto: Jan van der Wolf · Licencia Pexels · Pexels

Hecho Qué ha ocurrido

El grupo DrivingBench probó a GPT-6 Astra, Claude Fable 5.1, Grok 4.6 y GPT-5.6 Sol para conducir un Toyota Corolla real en un circuito cerrado de 130 metros, a velocidad reducida y con una persona lista para frenar. Solo GPT-6 Astra completó el recorrido; GPT-5.6 Sol avanzó alrededor del 6% del trazado y Grok 4.6 alrededor del 11%. Algunos modelos se negaron ocasionalmente a conducir al detectar un vehículo físico.

Resumen generado mediante IA a partir de El Confidencial Tecnología. Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Muestra que los modelos de propósito general pueden interpretar imágenes y ejecutar órdenes de conducción, pero con una fiabilidad muy irregular. Para una empresa, la lección es que la autonomía física aún está lejos de ser predecible.

Quién se ve afectado
Fabricantes de automoción, empresas de movilidad y equipos que planteen agentes de IA sobre sistemas físicos.
Qué puede cambiar
Por ahora no cambia ninguna práctica operativa. El resultado sugiere que la conducción mediante modelos generalistas es una línea de investigación y no un producto cercano.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Si DrivingBench repite los ensayos con más intentos y circuitos distintos, y si otros laboratorios publican resultados comparables con evaluaciones de seguridad independientes.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: El Confidencial Tecnología. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMmultimodalagentes DrivingBenchOpenAIAnthropicxAIToyota Claude Fable 5.1conducción autónomaDrivingBenchGPT-6 AstraGrok 4.6

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

Un estudio de Harvard halla que los agentes de código generan más código, pero no más software

Un estudio de los investigadores de Harvard Fiona Chen y James Stratton, basado en datos agregados de la plataforma Jellyfish, analiza más de 700 empresas de…

Por qué importaLas ganancias de productividad de los asistentes de código no se trasladan automáticamente al producto final si la revisión y los procesos…

Impacto medio Fiabilidad una fuente fiable Relevancia 7/10 Ars Technica AI
Investigación

Matemáticos necesitarán años para entender la avalancha de resultados de OpenAI

OpenAI publicó de forma repentina una gran cantidad de resultados matemáticos. Más de treinta y tres matemáticos consultados por The Verge describen la…

Por qué importaSi los resultados se confirman, la IA podría estar aportando avances en matemáticas a una escala nueva, lo que afecta a cómo se evalúan y validan los…

Impacto bajo Fiabilidad una fuente fiable Relevancia 7/10 The Verge AI
Investigación

Un modelo de IA de OpenAI acierta más que los médicos en el triage de una guardia

Un estudio publicado en la revista Science comparó el modelo o1 de OpenAI con dos médicos en 79 casos reales de la guardia del Beth Israel Deaconess Medical…

Por qué importaMuestra que los modelos de razonamiento pueden competir con profesionales en decisiones con información incompleta, un escenario frecuente en la…

Impacto medio Fiabilidad declaración interesada Relevancia 7/10 La Nación Tecnología

Claude Science de Anthropic elabora el primer mapa ultravioleta completo del cielo

El astrofísico Brice Ménard, de Johns Hopkins University, usó Claude Science para cartografiar todo el cielo en luz ultravioleta por primera vez. Agentes de IA…

Por qué importaMuestra cómo los agentes de IA pueden asumir tareas de preparación y calibración de datos que consumen mucho tiempo en investigación. Para cualquier…

Impacto bajo Fiabilidad declaración interesada The Decoder