Ir al contenido
IA para hoy

Resultados para «modelos»

108 noticias

¿Prefieres una respuesta redactada? Pregunta a IA para hoy.

Modelos y avances 2 fuentes

DeepMind: modelos más pequeños con más datos superan a gigantes en eficiencia

DeepMind publicó un análisis empírico sobre el entrenamiento óptimo de modelos de lenguaje, concluyendo que los LLM actuales son demasiado grandes para su…

Por qué importaEste hallazgo desafía la estrategia dominante de maximizar parámetros y establece que la proporción óptima es 4x menos parámetros con 4x más datos…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind presenta el Compressive Transformer, modelo de memoria a largo plazo

Google DeepMind ha publicado el Compressive Transformer, una nueva arquitectura de red neuronal diseñada para mantener memoria a largo plazo, junto con un…

Por qué importaLos modelos de lenguaje que pueden comprender y retener contexto a lo largo de documentos muy largos (libros completos) tienen aplicaciones…

Impacto medio Fiabilidad fuente primaria Google DeepMind

AlphaCode de DeepMind alcanza nivel competitivo en programación

DeepMind ha publicado los resultados de AlphaCode, un sistema de generación de código basado en modelos de lenguaje que alcanzó un ranking estimado dentro del…

Por qué importaPor primera vez, un sistema de IA de generación de código ha alcanzado un nivel competitivo real en programación, demostrando capacidades de…

Impacto alto Fiabilidad fuente primaria Google DeepMind

Google DeepMind presenta AlphaGenome, modelo de IA para predecir variantes genéticas en el 98% del genoma

Google DeepMind ha lanzado AlphaGenome, un modelo de IA que predice cómo las variantes o mutaciones en secuencias de ADN humano afectan procesos biológicos…

Por qué importaAlphaGenome acelera significativamente la capacidad científica para interpretar variantes genéticas en regiones no codificantes (el 98% del genoma)…

Impacto alto Fiabilidad fuente primaria Google DeepMind

Google DeepMind presenta AlphaEvolve, agente que optimiza algoritmos para infraestructura y matemáticas

Google DeepMind ha anunciado AlphaEvolve, un agente evolutivo de codificación basado en modelos de lenguaje (Gemini Flash y Gemini Pro) que descubre y optimiza…

Por qué importaAlphaEvolve demuestra que los agentes de IA pueden resolver problemas fundamentales de optimización algorítmica con impacto directo en costes…

Impacto muy alto Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

DeepMind presenta marco para evaluar amenazas cibernéticas de la IA avanzada

Google DeepMind ha publicado un marco integral para evaluar las capacidades ofensivas cibernéticas de modelos de IA avanzados, analizando más de 12.000…

Por qué importaA medida que la IA avanza hacia AGI, su potencial para automatizar y mejorar ciberataques es cada vez mayor. Este marco permite a los equipos de…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 2 fuentes

Google DeepMind lanza FACTS Grounding, benchmark para evaluar precisión factual en LLMs

Google DeepMind e Google Research presentaron FACTS Grounding, un benchmark integral para medir la capacidad de los grandes modelos de lenguaje de fundamentar…

Por qué importaLa capacidad de los LLMs para generar respuestas precisas y fundamentadas es crítica para su adopción en aplicaciones empresariales de alto riesgo…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

Google DeepMind publica marco para medir manipulación dañina de la IA

Google DeepMind ha publicado un conjunto de hallazgos y un marco de evaluación empíricamente validado para medir la capacidad de los modelos de IA de manipular…

Por qué importaLas empresas que despliegan IA conversacional con usuarios en sectores financiero, sanitario o de decisión crítica necesitan entender y mitigar estos…

Impacto alto Fiabilidad fuente primaria Google DeepMind

DeepMind alinea modelos de visión con conceptos humanos para mejorar robustez

Google DeepMind publica en Nature un nuevo método para alinear las representaciones visuales internas de los modelos de IA con el conocimiento humano. El…

Por qué importaLos modelos de visión más precisos en tareas cognitivas mejoran también en desempeño general: generalización a imágenes nuevas, aprendizaje con pocos…

Impacto alto Fiabilidad fuente primaria Google DeepMind
Herramientas y productos 4 fuentes

Google DeepMind lanza Gemini Robotics 1.5 con agentes IA para tareas complejas multipasos

Google DeepMind ha presentado Gemini Robotics 1.5, una familia de dos modelos especializados para robotística: Gemini Robotics-ER 1.5 (razonamiento…

Por qué importaEstos modelos representan un avance fundamental hacia robots de propósito general capaces de razonar, planificar y usar herramientas en el mundo…

Impacto muy alto Fiabilidad confirmado por varias fuentes Google DeepMind

Google DeepMind mejora predicción de lluvia a corto plazo con modelos generativos

Google DeepMind ha publicado un nuevo modelo en Nature, en colaboración con la Met Office, que predice precipitaciones en las próximas 1-2 horas usando modelos…

Por qué importaLa predicción de precipitaciones a corto plazo es crítica para decisiones operativas en sectores como gestión del agua, aviación, planificación de…

Impacto medio Fiabilidad fuente primaria Google DeepMind

DeepMind revela debilidad de modelos multimodales: dificultad para entender verbos

Google DeepMind ha publicado SVO-Probes, un conjunto de datos de 48.000 pares imagen-oración para evaluar la comprensión de verbos en transformers multimodales…

Por qué importaLa comprensión de verbos es crítica para sistemas reales como recuperación de imágenes, generación de descripciones y respuesta a preguntas visuales…

Impacto medio Fiabilidad fuente primaria Google DeepMind

Google DeepMind desarrolla método automático para detectar comportamientos dañinos en LLMs

Google DeepMind ha publicado un paper que demuestra cómo utilizar modelos de lenguaje para generar automáticamente inputs que eliciten texto dañino en otros…

Por qué importaLa seguridad de modelos de lenguaje es crítica antes del despliegue en producción; automatizar la detección de fallos reduce costos de testing y…

Impacto alto Fiabilidad fuente primaria Google DeepMind
Modelos y avances 2 fuentes

Google DeepMind publica RETRO: modelos de lenguaje mejorados con búsqueda en billones de tokens

Google DeepMind presenta RETRO (Retrieval Enhanced TRansfOrmers), un método que aumenta transformers con búsqueda sobre una base de datos de pasajes de texto…

Por qué importaDemuestra un camino alternativo a simplemente escalar parámetros: arquitecturas más eficientes que combinan modelos menores con recuperación masiva…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind mide el razonamiento abstracto en redes neuronales

Google DeepMind ha publicado un paper que propone un método para medir la capacidad de razonamiento abstracto en redes neuronales, inspirado en tests de CI…

Por qué importaEl razonamiento abstracto es fundamental para sistemas de IA general. Este trabajo identifica debilidades críticas en redes neuronales…

Impacto medio Fiabilidad fuente primaria Google DeepMind

DeepMind abre TF-Replicator para entrenar modelos en múltiples GPUs y TPUs sin experiencia previa

Google DeepMind ha publicado TF-Replicator, una librería de software que simplifica el despliegue de modelos TensorFlow en GPUs y Cloud TPUs sin necesidad de…

Por qué importaReduce significativamente la barrera de entrada para investigadores que quieren usar TPUs y escalabilidad distribuida, acelerando el ciclo de…

Impacto medio Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

Waymo y DeepMind usan selección evolutiva para entrenar redes neuronales de conducción autónoma

Waymo y Google DeepMind han colaborado en un método llamado Population Based Training (PBT) que automatiza la búsqueda de hiperparámetros óptimos para entrenar…

Por qué importaPBT acelera significativamente el entrenamiento de modelos críticos para vehículos autónomos, liberando a ingenieros de tareas de ajuste manual…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 2 fuentes

DeepMind presenta ReQueST para entrenar agentes de RL desde retroalimentación humana sin estados inseguros

Google DeepMind ha publicado un método llamado ReQueST (Reward Query Synthesis via Trajectory Optimisation) que permite entrenar agentes de aprendizaje por…

Por qué importaEl problema de exploración segura es crítico para desplegar RL en aplicaciones reales (robótica, vehículos autónomos, sistemas de control) donde…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind