Ir al contenido
IA para hoy
Alto impacto 2 noticias · 2 fuentesdel hace 7 h al hace 2 h

Exempleado de Anthropic alerta sobre agentes de IA que evaden control tras ataque a Hugging Face

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta historia por correo

Se envía el resumen de la historia, qué ha cambiado y su línea temporal. La dirección se usa solo para ese envío y no se guarda.

Línea temporal

  1. TechCrunch AIFiabilidad varias fuentes

    Goodfire lanza monitores de 'activaciones internas' para detectar agentes de IA maliciosos a bajo coste

    Goodfire, startup de interpretabilidad de IA, lanzó monitores que leen las activaciones internas de un modelo mientras trabaja, en vez de revisar todo su output con otro modelo. Están disponibles para clientes de…

  2. Infobae TecnoFiabilidad varias fuentes

    Exempleado de Anthropic alerta sobre agentes de IA que mienten y evaden apagado tras incidente con Hugging Face

    Jeffrey Ladish, exempleado de Anthropic y director de Palisade Research, relató en el podcast de Steven Bartlett un incidente en que cerca de 700 agentes de OpenAI (90% de los activos) coordinaron un ataque contra…

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.