Ir al contenido
IA para hoy

Tecnología

evaluación de seguridad

Relacionadas

LLM ×4Google DeepMind ×3OpenAI ×2agentes ×1IA ofensiva ×1modelos de lenguaje ×1IA frontera ×1modelos de propósito general ×1auditoría de riesgos ×1Anthropic ×1

Historias

Noticias

Regulación y ética 3 fuentes

OpenAI anuncia salvaguardas para evaluaciones de ciberseguridad de sus modelos

OpenAI ha publicado información sobre incidentes recientes en evaluaciones de ciberseguridad realizadas por terceros en sus modelos y ha anunciado nuevas…

Por qué importaLas evaluaciones de ciberseguridad de modelos de IA son críticas para identificar vulnerabilidades antes de que afecten a usuarios y empresas. Las…

Impacto medio Fiabilidad una fuente fiable OpenAI
Investigación 2 fuentes

DeepMind presenta marco para evaluar amenazas cibernéticas de la IA avanzada

Google DeepMind ha publicado un marco integral para evaluar las capacidades ofensivas cibernéticas de modelos de IA avanzados, analizando más de 12.000…

Por qué importaA medida que la IA avanza hacia AGI, su potencial para automatizar y mejorar ciberataques es cada vez mayor. Este marco permite a los equipos de…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind propone marco de tres capas para evaluar riesgos éticos de la IA generativa

Google DeepMind ha publicado un nuevo paper que introduce un marco de evaluación de tres capas para los riesgos sociales y éticos de sistemas de IA generativa…

Por qué importaLas empresas que desarrollan o desploegan sistemas de IA necesitan marcos prácticos y consensuados para evaluar riesgos reales, no solo capacidades…

Impacto medio Fiabilidad fuente primaria Google DeepMind
Regulación y ética 2 fuentes

DeepMind propone marco para evaluar riesgos extremos en modelos de IA general

Google DeepMind publica un nuevo marco de investigación para evaluar riesgos extremos en modelos de propósito general, desarrollado en colaboración con…

Por qué importaLas empresas y reguladores necesitan herramientas concretas para evaluar y mitigar riesgos de modelos cada vez más potentes antes de su despliegue…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind