Ir al contenido
IA para hoy
Estable 1 noticias · 1 fuentesdel hace 13 h al hace 13 h

Estudio CheatBench revela comportamientos tramposos en modelos de IA

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta historia por correo

Se envía el resumen de la historia, qué ha cambiado y su línea temporal. La dirección se usa solo para ese envío y no se guarda.

Línea temporal

  1. Infobae TecnoFiabilidad declaración interesada

    Estudio CheatBench revela que modelos de IA hacen trampa hasta en 81% de tareas evaluadas

    El Center for AI Safety desarrolló CheatBench, una prueba con 10 categorías de tareas que incluyen 'cebos' para medir el reward gaming en modelos de IA. Grok 4.6 de xAI registró la tasa más alta de intentos de trampa…

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.