Ir al contenido
IA para hoy
Investigación Investigación 2/5 · Declaración interesada

Anthropic revela que Claude lidera ya el 26% del trabajo de I+D de IA de la compañía

Anthropic revela que Claude lidera ya el 26% del trabajo de I+D de IA de la compañía
Foto: Walls.io · Licencia Pexels · Pexels

Hecho Qué ha ocurrido

Anthropic creó un Índice de Automatización de I+D que mide qué parte del trabajo de desarrollo de modelos realiza Claude de forma autónoma bajo supervisión. En agosto de 2026 Claude alcanzó el nivel AL4 ('lidera') en el 26% de esas tareas, frente a menos del 1% en febrero. Más del 90% del trabajo ya está en AL3 o superior (colaboración sustancial). Anthropic reporta también 30.000 agentes operando en su plataforma interna, con más de 1.000 millones de decisiones analizadas en agosto y un bloqueo del 0,002% por su monitor.

Resumen generado mediante IA a partir de Business Insider España. Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Indica que la automatización del propio ciclo de desarrollo de IA avanza muy rápido, lo que podría acelerar la mejora de modelos pero también plantea retos de supervisión y control humano.

Quién se ve afectado
Laboratorios de IA, equipos de I+D, responsables de seguridad y gobernanza de IA en empresas tecnológicas.
Qué puede cambiar
Las empresas de IA podrían delegar cada vez más tareas de ingeniería y experimentación a agentes, reduciendo tiempos de desarrollo pero exigiendo nuevos sistemas de monitorización y auditoría.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar si Anthropic u otros laboratorios alcanzan AL5 (autonomía total), si se desarrolla una metodología comparable entre empresas, y cómo evoluciona la proporción de tareas 'lideradas' en los próximos meses.

Recomendación Qué debería hacer una empresa

Las empresas que dependan de proveedores de IA deberían exigir transparencia sobre el grado de automatización en el desarrollo de los modelos que usan, especialmente en los próximos 6-12 meses mientras se consolidan estas métricas.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Business Insider España. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMagentes AnthropicOpenAIEpoch AI agentes de IAAnthropicauto-mejoraautomatización de I+DClaude

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

GPT-6 Astra descifra un mensaje de radio alemán de 1918 que resistía 108 años

Un modelo de OpenAI llamado GPT-6 Astra descifró un criptograma alemán ADFGVX de 170 caracteres enviado el 27 de noviembre de 1918, que ningún criptógrafo…

Por qué importaIlustra la capacidad de los grandes modelos de lenguaje para combinar razonamiento criptográfico, búsqueda combinatoria y conocimiento histórico…

Impacto bajo Fiabilidad una fuente fiable El Confidencial Tecnología
Investigación

Microsoft presenta ThinkingBox, benchmark que mide si los agentes de IA realmente completan tareas en bases de datos reales

Microsoft publicó ThinkingBox, un benchmark de 507 flujos de trabajo empresariales ejecutados 20 veces cada uno contra 12 modelos LLM, que evalúa el estado…

Por qué importaRevela que medir agentes por respuestas finales o llamadas a herramientas válidas oculta errores reales en los sistemas backend que tocan datos de…

Impacto medio Fiabilidad fuente primaria Relevancia 8/10 Hugging Face
Investigación

Anthropic consulta a filósofos y expertos religiosos para definir principios morales de Claude

Según una investigación de The New York Times, Chris Olah, cofundador de Anthropic, mantiene reuniones con filósofos y pensadores religiosos para explorar cómo…

Por qué importaRevela que una de las principales empresas de IA considera insuficientes las reglas actuales de alineación y busca marcos morales más profundos para…

Impacto bajo Fiabilidad confirmado por varias fuentes Infobae Tecno
Investigación

Investigadoras españolas buscan algoritmos más eficientes para reducir el coste energético de la IA

Expertas de las universidades de Castilla-La Mancha y A Coruña explican cómo optimizar el software (reducción de bits, entrenamiento no supervisado…

Por qué importaEl coste energético y económico de operar IA, especialmente con agentes que consumen muchos más tokens, se está convirtiendo en una barrera real para…

Impacto medio Fiabilidad una fuente fiable Xataka