Tecnología
alineamiento
Evolución en 16 semanas
El momentum semanal se estima con la misma fórmula que el momentum actual: volumen, aceleración respecto a la semana anterior, diversidad de fuentes e impacto.
Relacionadas
LLM ×3OpenAI ×2Anthropic ×2Google DeepMind ×1agentes conversacionales ×1
Historias
Noticias
Ex ingeniero de OpenAI y Anthropic dimite y denuncia que ambas ocultan riesgos reales de la IA
Jacob Coxon, investigador de preentrenamiento que trabajó en OpenAI y luego en Anthropic, ha dimitido y abandona la industria alegando que ambas empresas…
Por qué importaEs una denuncia interna, no externa, que cuestiona la narrativa de seguridad que Anthropic usa como diferenciador de marca frente a OpenAI. La…
Investigador de seguridad de Anthropic estima más de 10% de riesgo existencial por IA en una década
Evan Hubinger, responsable de alineación en Anthropic, afirmó en X que existe más de un 10% de probabilidad de que la IA acabe con la humanidad en la próxima…
Por qué importaQue responsables de seguridad de un laboratorio líder admitan públicamente falta de un plan de alineamiento robusto añade presión sobre la gobernanza…
DeepMind propone alineación de modelos conversacionales según el contexto
Google DeepMind publica un paper que propone un enfoque basado en pragmática lingüística para alinear agentes conversacionales con valores humanos. El trabajo…
Por qué importaPropone un marco conceptual diferente al de reducción de riesgos: en lugar de evitar daños, busca definir qué es una conversación exitosa en cada…


