Ir al contenido
IA para hoy

Resultados para «red teaming»

3 noticias

¿Prefieres una respuesta redactada? Pregunta a IA para hoy.

Abliteration.ai comercializa modelos de IA sin salvaguardas como servicio

La startup Abliteration.ai ofrece acceso vía web o API a versiones modificadas de modelos open-weight, incluido GLM-5.3 de Z.ai, con sus guardrails eliminados…

Por qué importaPlantea un dilema central para la seguridad de la IA: facilitar el acceso a modelos sin restricciones puede ayudar a equipos de defensa (red teaming)…

Impacto alto Fiabilidad una fuente fiable TechCrunch AI

Google DeepMind desarrolla método automático para detectar comportamientos dañinos en LLMs

Google DeepMind ha publicado un paper que demuestra cómo utilizar modelos de lenguaje para generar automáticamente inputs que eliciten texto dañino en otros…

Por qué importaLa seguridad de modelos de lenguaje es crítica antes del despliegue en producción; automatizar la detección de fallos reduce costos de testing y…

Impacto alto Fiabilidad fuente primaria Google DeepMind