Ir al contenido
IA para hoy

Tecnología

alineamiento

Evolución en 16 semanas

Noticias por semana y momentum estimado por semana 1 8,5 2 17 27/05 17/06 08/07 29/07 19/08 09/09: 2 09/09 27/05: 003/06: 010/06: 017/06: 024/06: 001/07: 008/07: 015/07: 022/07: 029/07: 005/08: 012/08: 019/08: 026/08: 002/09: 009/09: 17
Noticias por semana Momentum estimado · Fuentes distintas en la última semana: 2

El momentum semanal se estima con la misma fórmula que el momentum actual: volumen, aceleración respecto a la semana anterior, diversidad de fuentes e impacto.

Relacionadas

LLM ×3OpenAI ×2Anthropic ×2Google DeepMind ×1agentes conversacionales ×1

Historias

Noticias

Regulación y ética 4 fuentes

Ex ingeniero de OpenAI y Anthropic dimite y denuncia que ambas ocultan riesgos reales de la IA

Jacob Coxon, investigador de preentrenamiento que trabajó en OpenAI y luego en Anthropic, ha dimitido y abandona la industria alegando que ambas empresas…

Por qué importaEs una denuncia interna, no externa, que cuestiona la narrativa de seguridad que Anthropic usa como diferenciador de marca frente a OpenAI. La…

Impacto bajo Fiabilidad confirmado por varias fuentes Relevancia 8/10 eldiario.es Tecnología
Regulación y ética 4 fuentes

Investigador de seguridad de Anthropic estima más de 10% de riesgo existencial por IA en una década

Evan Hubinger, responsable de alineación en Anthropic, afirmó en X que existe más de un 10% de probabilidad de que la IA acabe con la humanidad en la próxima…

Por qué importaQue responsables de seguridad de un laboratorio líder admitan públicamente falta de un plan de alineamiento robusto añade presión sobre la gobernanza…

Impacto bajo Fiabilidad confirmado por varias fuentes Expansión Economía Digital
Investigación

DeepMind propone alineación de modelos conversacionales según el contexto

Google DeepMind publica un paper que propone un enfoque basado en pragmática lingüística para alinear agentes conversacionales con valores humanos. El trabajo…

Por qué importaPropone un marco conceptual diferente al de reducción de riesgos: en lugar de evitar daños, busca definir qué es una conversación exitosa en cada…

Impacto bajo Fiabilidad fuente primaria Google DeepMind