Ir al contenido
IA para hoy

Lo esencial del día

Un nuevo test muestra a la IA reescribiendo software complejo por su cuenta

13 de abril de 2026, 14:00

El día lo marca la investigación: un benchmark de METR y Epoch sitúa a los modelos actuales resolviendo tareas de ingeniería que a un humano le llevarían semanas. En paralelo, la infraestructura para agentes y la personalización de modelos siguen madurando, mientras se discute cuánta IA se usa realmente dentro de las grandes tecnológicas.

MirrorCode: reimplementar 16.000 líneas sin ver el código

Fotografía de archivo que ilustra: MirrorCode: la IA reimplementa código complejo de miles de líneas de forma autónoma
Foto: Godfrey Atima · Licencia Pexels · Pexels

METR y Epoch presentan un benchmark que mide si un modelo puede reimplementar programas complejos sin acceso al código fuente; Claude Opus 4.6 lo logró con un toolkit de bioinformática de unas 16.000 líneas en Go. El rendimiento mejora al aumentar los tokens de inferencia, lo que apunta a que más cómputo permitiría abordar proyectos mayores.

AWS explica cómo construir funciones de recompensa con Lambda

Ilustración generada con IA sobre: AWS Lambda para funciones de recompensa en personalización de Amazon Nova
Ilustración generada con IA por IA para hoy

Amazon publica una guía para ajustar por refuerzo sus modelos Nova, con opción de recompensas verificables o retroalimentación de IA e integración con Bedrock, SageMaker y CloudWatch. Reduce la dependencia de datos etiquetados y acerca la personalización de modelos a equipos sin especialistas en aprendizaje automático.

Debate sobre la adopción real de IA en Google

Ilustración generada con IA sobre: Steve Yegge cuestiona la adopción de IA en Google; ejecutivos responden que contradice datos internos
Ilustración generada con IA por IA para hoy

Steve Yegge sostiene que la adopción interna en Google sigue la curva habitual del sector; Addy Osmani responde con más de 40.000 ingenieros usando herramientas agenticas cada semana y Demis Hassabis habla de "clickbait". El episodio recuerda lo difícil que es verificar las cifras de penetración que difunden las tecnológicas.

Vantage evalúa competencias blandas con avatares de IA

Ilustración generada con IA sobre: Google Research presenta Vantage, herramienta de IA para evaluar competencias del futuro
Ilustración generada con IA por IA para hoy

Google Research y la Universidad de Nueva York lanzan un experimento que mide pensamiento crítico, colaboración o resolución de conflictos mediante conversaciones simuladas. Los estudios muestran concordancia con expertos humanos comparable a la que existe entre dos evaluadores humanos, con una correlación de 0,88 en trabajos de creatividad.

Cloudflare suma GPT-5.4 y Codex a Agent Cloud

Ilustración generada con IA sobre: Cloudflare integra GPT-5.4 y Codex de OpenAI en su plataforma Agent Cloud
Ilustración generada con IA por IA para hoy

La plataforma de agentes de Cloudflare incorpora modelos de OpenAI para desplegar y escalar agentes en tareas reales. Simplifica la integración y la seguridad para empresas que ya operan sobre su infraestructura.

Conviene vigilar si la mejora con más cómputo en MirrorCode se sostiene: sería la señal más clara de hasta dónde puede llegar la automatización del desarrollo de software.

Días anteriores

Ver todo el archivo de resúmenes