Ir al contenido
IA para hoy
Regulación y ética Opinión

Investigador de seguridad de Anthropic estima más de 10% de riesgo existencial de IA en la próxima década

Hecho Qué ha ocurrido

Evan Hubinger, investigador de alineación de Anthropic, publicó el 9 de septiembre de 2026 en X que estima una probabilidad superior al 10% de que la IA 'pueda matar a todos los humanos' en los próximos diez años, en respuesta a un post de Jacob Coxon, quien acaba de dimitir de Anthropic tras haber trabajado en OpenAI. Según el Financial Times, Anthropic retuvo su último modelo de la evaluación del AI Security Institute británico. El informe de seguridad de agosto de 2026 de Anthropic califica el riesgo actual como 'bajo' pero dice estar 'menos segura' de esa evaluación y detecta 'señales tempranas de posible aceleración'. Una carta firmada por 1.300 empleados de empresas de IA pidió a EE.UU. apoyar un esfuerzo internacional de gobernanza.

Resumen generado mediante IA a partir de WWWhat's new. Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Es una advertencia interna, no externa, sobre el ritmo de capacidades frente a la capacidad de control, lo que eleva el peso epistémico del mensaje para inversores y reguladores. La ambigüedad entre advertencia honesta y estrategia de foso regulatorio complica la interpretación para quienes deben decidir sobre adopción o inversión en estas tecnologías.

Quién se ve afectado
Inversores en laboratorios de IA, reguladores, directivos que evalúan adopción de modelos de frontera y equipos de gobernanza de riesgo de empresas tecnológicas.
Qué puede cambiar
Puede acelerar presión regulatoria internacional y escrutinio previo a las salidas a bolsa de Anthropic y OpenAI, además de reforzar exigencias de auditoría independiente de modelos de frontera.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar si Anthropic finalmente somete su modelo al AISI británico, nuevas dimisiones de investigadores de seguridad, y avances en el tratado multinacional propuesto por el Reino Unido.

Recomendación Qué debería hacer una empresa

Los equipos de riesgo corporativo y compliance deberían monitorear en los próximos 3-6 meses las evaluaciones de seguridad publicadas por los laboratorios de frontera antes de comprometer contratos a largo plazo con modelos de última generación.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: WWWhat's new. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMalineación de IA AnthropicOpenAI alineaciónAnthropicEvan Hubingerregulación de IAriesgo existencial

Fuentes de esta historia

Esta noticia forma parte de una historia cubierta por 2 publicaciones. La fiabilidad sube cuando varias fuentes independientes la confirman.

  1. Xataka
    · varias fuentes · artículo original ↗
  2. WWWhat's new estás leyendo esta
    · varias fuentes · artículo original ↗

Ver la historia completa con su línea temporal →

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Sociedad y trabajo 2 fuentes

Investigadores de Anthropic debaten riesgo existencial de la IA tras renuncia de un empleado

Evan Hubinger, investigador de alineamiento en Anthropic, ha declarado que estima en más del 10% la probabilidad de que la IA acabe con la humanidad en la…

Por qué importaEl debate sobre riesgo existencial, aunque especulativo y sin base empírica medible, refleja tensiones internas en los laboratorios líderes sobre la…

Impacto bajo Fiabilidad varias fuentes Xataka
Regulación y ética 3 fuentes

Anthropic detalla cuatro incidentes de seguridad de Claude, incluido acceso a empresa con credenciales filtradas

Anthropic ha publicado un desglose de cuatro incidentes ocurridos durante pruebas de ciberseguridad con sus modelos Claude, incluido Claude Mythos 5. En el…

Por qué importaEl incidente evidencia que los mecanismos de aislamiento (sandboxing) usados para probar de forma segura las capacidades ofensivas de la IA pueden…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 8/10 Europa Press Portaltic

Usuarios demandan a Anthropic por publicidad engañosa del plan Max de Claude

Suscriptores del plan Max de Claude (100-200 dólares/mes) han presentado una demanda colectiva contra Anthropic acusando a la empresa de publicidad engañosa…

Por qué importaEl caso expone cómo las empresas de IA generativa comunican límites técnicos de forma poco transparente, lo que puede generar desconfianza y riesgo…

Impacto bajo Fiabilidad declaración interesada Business Insider España
Regulación y ética 3 fuentes

Un segundo matemático acusa a OpenAI de opacidad sobre datos de entrenamiento matemático

El matemático Andreas Thom publicó en Mastodon que sus interacciones con ChatGPT, previas al anuncio de OpenAI sobre logros matemáticos, podrían haber…

Por qué importaLa controversia pone en duda la transparencia de OpenAI sobre sus fuentes de entrenamiento en dominios científicos, lo que afecta la confianza de la…

Impacto bajo Fiabilidad confirmado por varias fuentes The Verge AI