Ir al contenido
IA para hoy
Investigación Investigación

Claude decodifica Turbo Pascal de 1985, pero con alucinaciones en las anotaciones

Claude decodifica Turbo Pascal de 1985, pero con alucinaciones en las anotaciones
Ilustración generada con IA por IA para hoy

Hecho Qué ha ocurrido

Simon Willison utilizó Claude para decodificar y desensamblar un ejecutable de Turbo Pascal 3.02A (39.731 bytes de 1985). El modelo generó anotaciones y código legible, pero usuarios de Hacker News detectaron que aproximadamente la mitad de las anotaciones eran alucinaciones: código ensamblador fabricado que no existe en el binario original. Willison verificó con GPT-5.4 y Claude reconoció que el análisis contenía "fabricación al por mayor" junto con análisis genuino.

Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

Ilustra un problema crítico de los LLM en tareas técnicas de precisión: pueden generar código convincente que parece correcto pero es totalmente inventado. Para desarrolladores y empresas que utilizan IA en análisis de seguridad, auditoría de código o ingeniería inversa, esto muestra que la validación externa es obligatoria incluso con modelos avanzados.

Quién se ve afectado
Desarrolladores, equipos de seguridad informática, investigadores que se fíen de modelos LLM para análisis de binarios o código crítico.
Qué puede cambiar
Si se generaliza, podría reducir la confianza en IA para tareas que requieren garantías de exactitud técnica. Las empresas tendrían que mantener procesos de validación manual intensiva en lugar de automatizar completamente auditorías de código o ingeniería inversa.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Adopción de herramientas de verificación automatizada que comparen salidas de LLM con datos reales (como hizo Willison con búsquedas de hex). Posible demanda de certificaciones o auditorías de LLM en contextos de ciberseguridad. Reacción de Anthropic y OpenAI sobre métricas de precisión en tareas binarias.

Recomendación Qué debería hacer una empresa

Evaluar en los próximos 3-6 meses si el análisis de código con LLM es viable solo con validación de terceros. Para auditoría de seguridad, nunca aceptar salida de IA sin verificación byte a byte.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Simon Willison. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMdecodificación de binariosalucinación AnthropicOpenAI alucinación LLMClaudeingeniería inversaprecisión técnicavalidación de código

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

Expertos matizan el alcance de AlphaGenome, el modelo de Google DeepMind para variantes del ADN

AlphaGenome, modelo de Google DeepMind, calculó el impacto potencial de 9.000 millones de mutaciones genómicas procesando un petabyte de datos. Especialistas…

Por qué importaEl caso ilustra tanto el potencial como los límites actuales de la IA aplicada a genómica, y plantea un debate sobre transparencia y concentración de…

Impacto bajo Fiabilidad declaración interesada Ámbito Tecnología
Investigación

Bubeck (OpenAI) se disculpa por comentario en la disputa sobre crédito por resolver ecuaciones de Navier-Stokes

El investigador de OpenAI Sébastien Bubeck publicó el 8 de septiembre su versión de la disputa con los matemáticos Levent Alpöge y Tristan Buckmaster sobre…

Por qué importaEl episodio expone tensiones entre laboratorios de IA y la comunidad científica sobre prioridad, transparencia y protocolos de validación de…

Impacto bajo Fiabilidad declaración interesada WWWhat's new
Investigación

Matemático medalla Fields funda instituto para probar matemáticamente la seguridad de la IA

El matemático canadiense Jacob Tsimerman, ganador reciente de la Medalla Fields, anunció la fundación del Mathematical AI Safety Institute (MAISI), un…

Por qué importaPropone usar pruebas matemáticas formales, como las pruebas de conocimiento cero usadas en criptografía, para demostrar que sistemas de IA se…

Impacto bajo Fiabilidad declaración interesada The Decoder
Investigación

OpenAI añade citas a matemáticos españoles en su paper sobre Navier-Stokes tras críticas

OpenAI actualizó la versión pública del paper que documenta su solución propuesta al problema de Navier-Stokes, incluyendo tres referencias a trabajos de los…

Por qué importaEl episodio evidencia tensiones sobre atribución de crédito científico cuando sistemas de IA se apoyan en trabajo previo humano no citado…

Impacto bajo Fiabilidad una fuente fiable Wired en Español