Agentes de IA descubren errores de hace décadas en la literatura científica

Editado por: Svitlana Velhush

La inteligencia artificial se utiliza cada vez más activamente para la verificación de publicaciones y bases de datos científicas. Ejemplos recientes demuestran cómo los agentes de IA descubren imprecisiones que habían pasado desapercibidas durante décadas.

El químico teórico Sebastian Pios, del Zhejiang Lab en Hangzhou, empleó un modelo de IA para predecir los puntos de ebullición de las moléculas. El sistema arrojó valores que contradecían los datos de un manual de referencia de hace 75 años. Al principio, Pios sospechó un error del modelo, pero la revisión de las fuentes originales demostró lo contrario: los datos del manual eran los incorrectos.

En otros casos, la IA identificó una errata en un artículo y valores incorrectos de mediciones de puntos de ebullición de hace un siglo. Estos errores, según Pios, podrían haber causado numerosos problemas a los investigadores que utilizaban la base de datos.

Herramientas similares también se utilizan para auditar trabajos de conferencias. En un análisis de SAI Labs, agentes de IA examinaron 168 artículos de presentaciones orales del ICML 2026. De los 92 trabajos con suficientes afirmaciones verificables, los agentes solo pudieron reproducir más de dos de los cinco puntos clave en 34 casos. Completamente, es decir, más del 80% de las afirmaciones, solo se lograron reproducir en ocho artículos.

James Zou de Stanford y sus colegas desarrollaron un "verificador de IA" que escaneó artículos de NeurIPS. El número de errores objetivos en fórmulas, cálculos y figuras aumentó de 3,8 por artículo en 2021 a 5,9 en 2025, un incremento del 55%. Estas herramientas permiten trabajar a una escala inalcanzable para los seres humanos.

Sin embargo, los expertos advierten: la IA también comete errores. Odd Erik Gundersen, de la Universidad Noruega de Ciencia y Tecnología, subraya la necesidad de supervisión humana. ¿Cómo garantizar la fiabilidad del conocimiento científico en la era de la verificación automatizada?

El análisis se centra en errores objetivos, dejando las cuestiones de novedad y relevancia a criterio de los humanos. Esto ayuda a evitar sobrecargar la IA con juicios subjetivos.

12 Vues

Fuentes

  • AI agents are checking the scientific literature — and spotting decades-old errors

Lea más artículos sobre este tema:

Trump admin revokes visa of Brazilian ambassador to US The Trump administration has revoked the visa of Brazil’s ambassador to the US, escalating a rift between Washington and Brasilia. The State Department did not declare Amb. Maria Luiza Ribeiro Viotti to be “persona

Image
Reply
¿Encontró un error o inexactitud?Consideraremos sus comentarios lo antes posible.