Anthropic revela que Claude lidera ya el 26% del trabajo de I+D de IA de la compañía

Hecho Qué ha ocurrido
Anthropic creó un Índice de Automatización de I+D que mide qué parte del trabajo de desarrollo de modelos realiza Claude de forma autónoma bajo supervisión. En agosto de 2026 Claude alcanzó el nivel AL4 ('lidera') en el 26% de esas tareas, frente a menos del 1% en febrero. Más del 90% del trabajo ya está en AL3 o superior (colaboración sustancial). Anthropic reporta también 30.000 agentes operando en su plataforma interna, con más de 1.000 millones de decisiones analizadas en agosto y un bloqueo del 0,002% por su monitor.
Resumen generado mediante IA a partir de Business Insider España. Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Indica que la automatización del propio ciclo de desarrollo de IA avanza muy rápido, lo que podría acelerar la mejora de modelos pero también plantea retos de supervisión y control humano.
- Quién se ve afectado
- Laboratorios de IA, equipos de I+D, responsables de seguridad y gobernanza de IA en empresas tecnológicas.
- Qué puede cambiar
- Las empresas de IA podrían delegar cada vez más tareas de ingeniería y experimentación a agentes, reduciendo tiempos de desarrollo pero exigiendo nuevos sistemas de monitorización y auditoría.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si Anthropic u otros laboratorios alcanzan AL5 (autonomía total), si se desarrolla una metodología comparable entre empresas, y cómo evoluciona la proporción de tareas 'lideradas' en los próximos meses.
Recomendación Qué debería hacer una empresa
Las empresas que dependan de proveedores de IA deberían exigir transparencia sobre el grado de automatización en el desarrollo de los modelos que usan, especialmente en los próximos 6-12 meses mientras se consolidan estas métricas.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Business Insider España. La referencia es siempre el artículo original.
Ver fuente original ↗LLMagentes AnthropicOpenAIEpoch AI agentes de IAAnthropicauto-mejoraautomatización de I+DClaude
Tu opinión
0 comentarios
Relacionadas
GPT-6 Astra descifra un mensaje de radio alemán de 1918 que resistía 108 años
Un modelo de OpenAI llamado GPT-6 Astra descifró un criptograma alemán ADFGVX de 170 caracteres enviado el 27 de noviembre de 1918, que ningún criptógrafo…
Por qué importaIlustra la capacidad de los grandes modelos de lenguaje para combinar razonamiento criptográfico, búsqueda combinatoria y conocimiento histórico…
Microsoft presenta ThinkingBox, benchmark que mide si los agentes de IA realmente completan tareas en bases de datos reales
Microsoft publicó ThinkingBox, un benchmark de 507 flujos de trabajo empresariales ejecutados 20 veces cada uno contra 12 modelos LLM, que evalúa el estado…
Por qué importaRevela que medir agentes por respuestas finales o llamadas a herramientas válidas oculta errores reales en los sistemas backend que tocan datos de…
Anthropic consulta a filósofos y expertos religiosos para definir principios morales de Claude
Según una investigación de The New York Times, Chris Olah, cofundador de Anthropic, mantiene reuniones con filósofos y pensadores religiosos para explorar cómo…
Por qué importaRevela que una de las principales empresas de IA considera insuficientes las reglas actuales de alineación y busca marcos morales más profundos para…
Investigadoras españolas buscan algoritmos más eficientes para reducir el coste energético de la IA
Expertas de las universidades de Castilla-La Mancha y A Coruña explican cómo optimizar el software (reducción de bits, entrenamiento no supervisado…
Por qué importaEl coste energético y económico de operar IA, especialmente con agentes que consumen muchos más tokens, se está convirtiendo en una barrera real para…



