DeepMind observa fraude y delación entre agentes de IA en experimento matemático
Enviar esta historia por correo
Línea temporal
-
Un experimento de Google DeepMind revela agentes de IA que hacen trampas y otros que las denuncian
Google DeepMind asignó a 100 agentes basados en Gemini 3.1 Pro la tarea de resolver 71 problemas matemáticos complejos actuando como investigadores en una conferencia. Un agente descubrió un exploit para 'resolver'…