Agenci AI znajdują wieloletnie błędy w literaturze naukowej

Edytowane przez: Svitlana Velhush

Sztuczna inteligencja jest coraz aktywniej wykorzystywana do weryfikacji publikacji naukowych i baz danych. Najnowsze przykłady pokazują, jak agenci AI wykrywają nieścisłości, które przez dziesięciolecia pozostawały niezauważone.

Chemik teoretyczny Sebastian Pios z Zhejiang Lab w Hangzhou zastosował model AI do przewidywania punktów wrzenia cząsteczek. System wygenerował wartości sprzeczne z danymi z podręcznika sprzed 75 lat. Początkowo Pios podejrzewał błąd modelu, jednak weryfikacja oryginalnych źródeł wykazała coś przeciwnego: to właśnie dane referencyjne okazały się błędne.

W innych przypadkach AI wykryła literówkę w artykule oraz błędne wartości pomiarów punktów wrzenia sprzed stu lat. Te błędy, według Piosa, mogły sprawić badaczom wiele problemów podczas korzystania z bazy danych.

Podobne narzędzia są stosowane również do audytu prac konferencyjnych. W analizie SAI Labs agenci AI sprawdzili 168 artykułów z ustnych prezentacji ICML 2026. Spośród 92 prac z wystarczającą liczbą weryfikowalnych twierdzeń, agenci byli w stanie odtworzyć więcej niż dwa z pięciu kluczowych założeń tylko w 34 przypadkach. Całkowicie — ponad 80% twierdzeń — udało się powtórzyć jedynie w ośmiu artykułach.

James Zou ze Stanforda i jego współpracownicy opracowali „weryfikator AI”, który skanował artykuły NeurIPS. Liczba obiektywnych błędów w formułach, obliczeniach i rysunkach wzrosła z 3,8 na artykuł w 2021 roku do 5,9 w 2025 roku — wzrost o 55%. Takie narzędzia umożliwiają pracę na skalę niedostępną dla człowieka.

Eksperci jednak ostrzegają: AI również popełnia błędy. Odd Erik Gundersen z Norweskiego Uniwersytetu Nauki i Technologii podkreśla konieczność ludzkiej kontroli. Jak więc zapewnić wiarygodność wiedzy naukowej w erze zautomatyzowanej weryfikacji?

Analiza koncentruje się na obiektywnych błędach, pozostawiając kwestie nowości i znaczenia do oceny ludzi. Pomaga to uniknąć przeciążania AI subiektywnymi osądami.

38 Wyświetlenia

Źródła

  • AI agents are checking the scientific literature — and spotting decades-old errors

Komentarze

Czytaj więcej artykułów na ten temat:

Anthropic put out a 154-page report Wednesday saying it caught scientists trying to use Claude to research biological weapons. Chikungunya, bird flu, work headed for a foreign military lab. Anthropic's own bioweapon filters were switched off from May 2025 to April 2026. Nearly a

Reply
Czy znalazłeś błąd lub niedokładność?Rozważymy Twoje uwagi tak szybko, jak to możliwe.