Tecnología
red teaming automático
Relacionadas
Historias
Noticias
OpenAI presenta GPT-Red: sistema automático de prueba de seguridad mediante autoplay
OpenAI ha desarrollado GPT-Red, un sistema automático de red teaming que utiliza autoplay para mejorar la robustez, seguridad y alineación de modelos de IA…
Por qué importaPara cualquier organización que use IA en producción, la robustez frente a ataques de inyección de prompts es crítica; un sistema que mejore…
Impacto alto
Fiabilidad fuente primaria
OpenAI
Google DeepMind refuerza Gemini 2.5 contra inyecciones de prompt indirecto
Google DeepMind ha publicado un white paper detallando las mejoras de seguridad en Gemini 2.5, posicionándola como su familia de modelos más segura. El…
Por qué importaLos agentes de IA operan cada vez más con acceso a datos externos (calendarios, documentos, sitios web), creando una superficie de ataque real para…
Impacto alto
Fiabilidad fuente primaria
Google DeepMind