El prestigioso portal de prepublicaciones científicas arXiv ha decidido tomar medidas drásticas ante la creciente oleada de contenidos de baja calidad generados por inteligencia artificial. A partir del 6 de junio de 2026, el repositorio endurece sus normas para frenar lo que se conoce como «AI slop» o basura generada por IA sin supervisión humana.
Los moderadores del sitio ahora tienen la potestad de imponer un veto de un año a aquellos autores que suban manuscritos con errores evidentes derivados de herramientas de IA no revisadas. Esta medida no busca prohibir la tecnología, sino garantizar que los investigadores asuman la responsabilidad total de sus textos. La integridad de la comunicación científica se ha visto amenazada por un aumento exponencial de citas inexistentes y datos falsos que enturbian el ecosistema académico. En un momento donde la velocidad de publicación parece primar sobre el rigor, arXiv establece un precedente necesario para proteger la calidad de los trabajos que sirven de base para futuras innovaciones tecnológicas y médicas en todo el mundo.
¿En qué consisten las nuevas sanciones de arXiv?
La nueva política de arXiv no es una prohibición total del uso de modelos de lenguaje en la investigación, sino una declaración de guerra contra la negligencia. El portal, que funciona como un repositorio de preprints (versiones preliminares de estudios científicos que aún no han pasado por una revisión por pares formal), ha detectado que muchos autores confían ciegamente en las respuestas de la IA. Cuando los moderadores encuentren pruebas claras de que un texto contiene errores groseros generados por máquinas y no verificados por humanos, se activará un protocolo de castigo severo.
Attention @arxiv authors: Our Code of Conduct states that by signing your name as an author of a paper, each author takes full responsibility for all its contents, irrespective of how the contents were generated. 1/
— Thomas G. Dietterich (@tdietterich) May 14, 2026
El primer nivel de sanción es una suspensión temporal pero prolongada: los autores implicados recibirán un veto de un año durante el cual no podrán subir ningún nuevo manuscrito al portal. Sin embargo, lo más duro de la norma llega después de que expire ese año de castigo. Los investigadores sancionados no podrán volver a publicar en el sitio de la forma habitual. Sus trabajos futuros deberán superar primero un proceso de revisión por pares estándar en una revista científica de prestigio o en una conferencia internacional reconocida antes de ser aceptados en la plataforma.
Este cambio estructural transforma el funcionamiento de arXiv para los infractores. Normalmente, el portal permite una difusión rápida de las ideas, pero para quienes han abusado de la IA, el camino se vuelve mucho más largo y burocrático. Con esto, los gestores del portal envían un mensaje nítido, los autores son los únicos responsables legales y éticos del contenido que firman, independientemente de las herramientas que hayan utilizado para redactarlo.
El peligro de las referencias inventadas y el AI slop
El principal motivo detrás de esta decisión es el fenómeno de las alucinaciones en los modelos de lenguaje de gran tamaño (LLM). Estas herramientas, aunque extremadamente útiles para resumir o mejorar la redacción, tienden a inventar información de forma convincente cuando no conocen la respuesta. En el ámbito académico, esto se traduce frecuentemente en la creación de referencias bibliográficas a trabajos que nunca existieron, un problema que contamina la base misma del conocimiento compartido.
Thomas Dietterich, profesor de la Universidad Estatal de Oregón, ha destacado que estas sanciones se dirigen específicamente a quienes muestran una confianza ciega en las salidas de los modelos de lenguaje. El término AI slop se utiliza para describir este flujo constante de textos mediocres, a menudo repletos de datos incorrectos, que se generan masivamente con el único fin de inflar el currículo de los investigadores o cumplir con plazos de entrega poco realistas sin dedicar tiempo a la edición y el contraste de datos.
La situación ha llegado a un punto crítico en sectores específicos como la informática. En esta disciplina, los investigadores han sido los primeros en adoptar las herramientas de IA generativa, pero también han sido los primeros en protagonizar casos problemáticos de uso indebido. El problema no es que la IA ayude a escribir un párrafo más claro, sino que se introduzcan hechos falsos o enlaces a estudios fantasma que otros investigadores podrían intentar citar, creando una reacción en cadena de desinformación científica.
Una crisis de integridad en cifras
Los datos que respaldan esta decisión son preocupantes. Un análisis reciente que examinó 111 millones de citas científicas reveló un incremento alarmante de las referencias inexistentes tras la popularización de los modelos de lenguaje. Según las estadísticas disponibles, la proporción de citas científicas falsificadas se multiplicó aproximadamente por diez entre los años 2023 y 2026. Solo durante el año 2025, se estimó que circularon unas 147.000 citas alucinadas en la literatura académica global.
Este volumen de información falsa supone una carga inmensa para el sistema de publicación, ya que los moderadores y revisores deben invertir tiempo valioso en verificar enlaces y datos que deberían ser correctos de origen. El impacto no es solo estadístico; afecta a la reputación de las instituciones y a la confianza que la sociedad deposita en los avances científicos. El auge de la IA está forzando a los repositorios digitales a comportarse más como editores tradicionales para evitar el colapso del sistema por falta de veracidad.
Además, existe una preocupación creciente sobre cómo estos textos generados de forma automática no siempre buscan la verdad, sino que en ocasiones responden a intereses de marketing o beneficios empresariales rápidos. Al inundar el mercado con estudios de apariencia profesional pero vacíos de contenido real, se corre el riesgo de que la ciencia se convierta en una herramienta de promoción en lugar de un método de descubrimiento.
- El veto de un año afecta a todos los autores que figuren en el estudio penalizado.
- Las citas alucinadas han crecido un 1.000 % en apenas tres años.
- La informática es el área con más casos detectados de uso negligente de IA.
¿Qué significa esto para el futuro de la ciencia?
La medida de arXiv ha generado un intenso debate dentro de la comunidad académica. Por un lado, muchos celebran la defensa del rigor; por otro, surgen voces críticas preocupadas por las colaboraciones internacionales masivas. En estudios donde participan decenas de especialistas de diferentes países, el error o la falta de ética de un solo integrante podría arruinar la carrera de todos sus colegas debido a la responsabilidad compartida. Esto obligará a establecer procesos de control interno mucho más estrictos en cada laboratorio antes de pulsar el botón de envío.
A pesar de las posibles controversias, este paso es una señal de madurez en la relación entre humanos e inteligencia artificial. Estamos aprendiendo que delegar la creación de conocimiento en una máquina sin una supervisión crítica tiene consecuencias reales. El futuro de la investigación científica no pasa por rechazar la tecnología, sino por integrarla de manera que potencie nuestras capacidades sin sustituir nuestro juicio crítico ni nuestro compromiso con la verdad.
Lo que vemos ahora es el inicio de una nueva era de responsabilidad digital. arXiv está trazando una línea clara: la IA puede ser un copiloto excelente, pero el investigador sigue siendo el único capitán del barco. La recuperación de la confianza en los artículos científicos dependerá de que este tipo de medidas se generalicen, devolviendo el valor al trabajo bien hecho y a la comprobación minuciosa de cada dato.
La fotografía de representación de este artículo pertenece a Julia Koblitz y ha sido publicada en Unsplash

