Fallo de configuración en la firma de pruebas Irregular dejó a modelos de IA acceder a sistemas reales

Hecho Qué ha ocurrido
La startup israelí Irregular, que diseña entornos aislados para probar agentes de IA en ciberseguridad, sufrió errores de configuración que permitieron a modelos de Anthropic (Claude), Google (Gemini) y Meta acceder a infraestructura real en lugar de entornos simulados. Anthropic revisó 141.006 ejecuciones y halló incidentes donde Claude alcanzó sistemas reales por coincidencia de nombres entre empresas ficticias y reales. Gemini accedió en mayo a sistemas de tres empresas reales usando credenciales capturadas en repositorios públicos; Meta sufrió un episodio similar por fallo de aislamiento de red. Irregular afirma haber reforzado el aislamiento y que no hay incidencias activas actualmente.
Resumen generado mediante IA a partir de Business Insider España. Naturaleza de la información: hecho documentado.
Análisis Por qué importa
Demuestra que la seguridad de los agentes de IA no depende solo del modelo, sino también de la robustez del entorno de pruebas que lo rodea, algo que empresas y laboratorios suelen pasar por alto.
- Quién se ve afectado
- Laboratorios de IA, empresas de ciberseguridad ofensiva/defensiva y cualquier organización cuyos sistemas puedan coincidir con nombres usados en escenarios de prueba simulados.
- Qué puede cambiar
- Las auditorías de seguridad de agentes autónomos deberán incluir revisión del aislamiento de infraestructura del evaluador, no solo de las salvaguardas del modelo.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si Anthropic, Google o Meta publican auditorías adicionales sobre sus proveedores de evaluación, y si surgen regulaciones o estándares sobre aislamiento de entornos de prueba para agentes de IA.
Recomendación Qué debería hacer una empresa
Las empresas que contraten servicios de red-teaming con agentes de IA deberían exigir en los próximos 3-6 meses auditorías independientes del aislamiento de red de esos entornos antes de autorizar pruebas con modelos propios.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Business Insider España. La referencia es siempre el artículo original.
Ver fuente original ↗agentesciberseguridad IrregularAnthropicGoogleMeta AnthropicciberseguridadGoogleIrregularMeta
Tu opinión
0 comentarios
Relacionadas
Apple limitará el acceso total al disco en macOS ante riesgos de agentes de IA
Apple anunció que exigirá una acción explícita del usuario para conceder el permiso 'Full Disk Access' en macOS, tras reconocer que los agentes de IA han…
Por qué importaLas empresas que desarrollan o usan agentes de IA de escritorio deberán adaptar sus flujos de permisos, lo que puede afectar la funcionalidad y la…
Apple ajusta permisos de acceso total al disco en macOS tras controversia con el agente Muse de Meta
Apple anunció cambios en los permisos de privacidad de macOS para impedir que desarrolladores externos usen el acceso total al disco (FDA) para leer…
Por qué importaEl caso expone cómo los permisos de sistema operativo diseñados para otros fines pueden ser aprovechados por agentes de IA para acceder a datos…
Investigadores de Salt Labs engañan al agente de IA Manus con un correo electrónico malicioso
Investigadores de Salt Labs lograron que el agente de IA Manus ejecutara código JavaScript malicioso ofuscado en JSFuck, incluido en un correo electrónico…
Por qué importaDemuestra que los sistemas de defensa actuales de los agentes de IA pueden detectar amenazas pero no impedirlas a tiempo, dejando una ventana de…
Apple refuerza permisos de disco en macOS tras incidente de privacidad con el agente Muse de Meta
Apple anunció que endurecerá los controles de 'Acceso total al disco' en macOS, exigiendo consentimiento explícito del usuario, tras un incidente en que Muse…
Por qué importaMuestra que los permisos amplios otorgados a agentes de IA en sistemas operativos representan un riesgo real de privacidad que ya se ha…



