SVO-Probes: evaluación de comprensión verbal en transformers multimodales
Línea temporal
-
DeepMind revela debilidad de modelos multimodales: dificultad para entender verbos
Google DeepMind ha publicado SVO-Probes, un conjunto de datos de 48.000 pares imagen-oración para evaluar la comprensión de verbos en transformers multimodales de lenguaje e imagen. Los resultados muestran que modelos…