Vulnerabilidad en trazas cifradas de razonamiento de APIs de IA propietarias
Enviar esta historia por correo
Línea temporal
-
Investigadores extraen razonamientos ocultos de modelos propietarios mediante trazas cifradas
Investigadores descubrieron una vulnerabilidad que permitía extraer las cadenas de razonamiento ocultas (chain-of-thought) cifradas devueltas por APIs de OpenAI, Anthropic y Google. El exploit funcionaba replicando…