Tecnología
modelos multimodales
Relacionadas
LLM ×2Hugging Face ×1generación de código ×1Google DeepMind ×1aprendizaje reforzado ×1RL ×1razonamiento matemático ×1
Historias
Noticias
Hugging Face reproduce con TRL y OpenEnv un modelo de código que pinta acuarelas mediante RL
Un ingeniero de Hugging Face reproduce en abierto un proyecto viral de Surya Narreddi que entrena un modelo de lenguaje para escribir JavaScript (usando…
Por qué importaIlustra cómo el RL con jueces de preferencia (no solo recompensas verificables) puede aplicarse a tareas creativas y subjetivas como el 'gusto…
Google DeepMind conmemora 10 años de AlphaGo y conecta su legado con el camino hacia AGI
Google DeepMind publica un análisis retrospectivo de AlphaGo en su décimo aniversario (2016–2026), destacando cómo sus métodos de búsqueda y aprendizaje…
Por qué importaEste documento ilustra cómo una arquitectura de IA diseñada para un juego ha derivado en herramientas científicas concretas (AlphaFold ha sido usado…