GPTZero detecta 100 citas fabricadas en 51 artículos aceptados por NeurIPS
Hecho Qué ha ocurrido
GPTZero, una startup de detección de IA, analizó los 4.841 artículos aceptados por la Conferencia sobre Sistemas de Procesamiento de Información Neural (NeurIPS) celebrada en San Diego en diciembre de 2025. El análisis identificó 100 citas alucinadas confirmadas como falsas distribuidas en 51 artículos. Aunque esto representa aproximadamente el 1,1% de los artículos analizados, es estadísticamente mínimo dentro del total de decenas de miles de citas presentes en la conferencia.
Resumen generado mediante IA a partir de TechCrunch AI (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
El hallazgo subraya un dilema de integridad académica que afecta a las conferencias más prestigiosas de IA: incluso investigadores de primer nivel están usando LLM de forma inexacta para tareas consideradas "tediosas" como escribir citas. Esto cuestiona cómo se puede confiar en sistemas LLM para tareas críticas cuando ni siquiera los expertos en IA pueden garantizar su precisión en detalles verificables.
- Quién se ve afectado
- Investigadores y académicos en IA, conferencias de investigación de alto nivel, pares revisores, y cualquier institución que dependa de la confiabilidad de publicaciones científicas como métrica de calidad.
- Qué puede cambiar
- Podría acelerar la implementación de herramientas de verificación automatizada en pipelines de revisión de conferencias. Igualmente, puede forzar cambios en políticas de divulgación de uso de LLM y en protocolos de verificación de referencias durante la revisión de pares.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Reacción de otras conferencias académicas (ICML, ICLR) ante hallazgos similares; adopción de métodos de verificación de citas mediante IA; cambios en políticas de NeurIPS y similares sobre declaración de uso de LLM; evolución del debate sobre confianza en papers de IA.
Recomendación Qué debería hacer una empresa
Las organizaciones que contraten a investigadores o validen papers de conferencias como métricas de calidad deberían considerar implementar verificación automatizada de citas en los próximos 6-12 meses, especialmente si planean usar estos trabajos para decisiones estratégicas.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: TechCrunch AI. La referencia es siempre el artículo original.
Ver fuente original ↗LLMdetección de IAalucinación GPTZeroConference on Neural Information Processing Systems alucinación de citasGPTZerointegridad académicaNeurIPSrevisión de pares
Tu opinión
0 comentarios
Relacionadas
Matemático acusa a OpenAI de falta de transparencia sobre resolución de un Problema del Milenio
El matemático Tristan Buckmaster denunció presiones y falta de transparencia por parte de OpenAI, después de que la compañía anunciara que sus modelos habían…
Por qué importaEl caso plantea dudas sobre atribución de méritos científicos, uso de datos de investigadores y comunicación corporativa de resultados de IA en…
DeepMind lanza AlphaGenome Atlas con predicciones de 9.000 millones de variantes del genoma humano
Google DeepMind ha publicado el AlphaGenome Atlas, un conjunto de datos de un petabyte que predice el efecto molecular de cada una de las aproximadamente nueve…
Por qué importaEsta base de datos podría acelerar drásticamente el diagnóstico de enfermedades raras y la investigación genética al reducir el tiempo necesario para…
Debate sobre el papel de la IA de OpenAI en la solución del problema de Navier-Stokes
OpenAI afirmó que su IA ayudó a resolver aspectos del problema matemático de Navier-Stokes, uno de los enigmas abiertos de la matemática desde hace casi 200…
Por qué importaEl caso ilustra la disputa creciente sobre atribución y verificación de resultados científicos cuando intervienen sistemas de IA, algo relevante para…
OpenAI afirma resolver parte del problema del milenio Navier-Stokes con IA, pero surge disputa de prioridad
OpenAI anunció el 8 de septiembre que un modelo interno más capaz que GPT-6 Astra produjo una prueba formal en Lean que resuelve dos de los cuatro enunciados…
Por qué importaEs el avance más significativo hasta ahora de IA en matemáticas de investigación de frontera, con verificación formal objetiva vía Lean, pero también…



