AI-agenten vinden decennia oude fouten in wetenschappelijke literatuur

Bewerkt door: Svitlana Velhush

Kunstmatige intelligentie wordt steeds actiever ingezet voor het controleren van wetenschappelijke publicaties en databases. Recente voorbeelden laten zien hoe AI-agenten onnauwkeurigheden opsporen die decennialang onopgemerkt zijn gebleven.

De theoretisch chemicus Sebastian Pios van Zhejiang Lab in Hangzhou gebruikte een AI-model om de kookpunten van moleculen te voorspellen. Het systeem gaf waarden die in tegenspraak waren met gegevens uit een 75 jaar oud naslagwerk. Aanvankelijk vermoedde Pios een fout in het model, maar controle van de originele bronnen bewees het tegendeel: de naslaggegevens bleken onjuist.

In andere gevallen ontdekte AI een typefout in een artikel en honderd jaar oude onjuiste meetwaarden voor kookpunten. Volgens Pios konden deze fouten onderzoekers veel problemen opleveren bij het gebruik van de database.

Dergelijke instrumenten worden ook gebruikt voor het auditen van conferentiepapers. In een analyse van SAI Labs controleerden AI-agenten 168 artikelen van mondelinge presentaties op ICML 2026.

Van de 92 studies met voldoende verifieerbare beweringen konden de agenten slechts in 34 gevallen meer dan twee van de vijf belangrijkste claims reproduceren. Volledig – meer dan 80% van de beweringen – kon slechts in acht artikelen worden herhaald.

James Zou van Stanford en zijn collega's ontwikkelden een “AI-checker” die NeurIPS-artikelen scande. Het aantal objectieve fouten in formules, berekeningen en figuren steeg van 3,8 per artikel in 2021 naar 5,9 in 2025 – een toename van 55%. Dergelijke instrumenten maken het mogelijk om op een schaal te werken die voor mensen onbereikbaar is.

Experts waarschuwen echter: AI maakt ook fouten. Odd Erik Gundersen van de Noorse Universiteit voor Wetenschap en Technologie benadrukt de noodzaak van menselijke controle. Hoe kunnen we de betrouwbaarheid van wetenschappelijke kennis waarborgen in een tijdperk van geautomatiseerde controles?

De analyse richt zich op objectieve fouten, waarbij vragen over nieuwheid en significantie aan mensen worden overgelaten. Dit helpt om te voorkomen dat AI wordt overbelast met subjectieve oordelen.

12 Weergaven

Bronnen

  • AI agents are checking the scientific literature — and spotting decades-old errors

Lees meer artikelen over dit onderwerp:

Trump admin revokes visa of Brazilian ambassador to US The Trump administration has revoked the visa of Brazil’s ambassador to the US, escalating a rift between Washington and Brasilia. The State Department did not declare Amb. Maria Luiza Ribeiro Viotti to be “persona

Image
Reply
Heb je een fout of onnauwkeurigheid gevonden?We zullen je opmerkingen zo snel mogelijk in overweging nemen.